锚定战略投资两大方向,澳鹏中国布局新十年超级周期

2025-03-12 16:08   来源: 前瞻科技网    浏览次数:4013

  大模型与生成式AI无疑已经成为实实在在的效率和增长引擎,而DeepSeek的问世则证明了算力和算法对于大模型普及的制约正在迅速降低,规模化的高质量标注数据特别是行业垂直领域(垂类)数据,正在成为大模型普及的下一个战场。2025年2月底澳鹏发布的年报显示:2024年公司中国业务营收突破4.2亿,年增长达到71%,其中的大模型/AIGC业务增长了526%,几乎所有AI龙头,特别是大模型AI企业都成为了澳鹏的客户。

  2022年底,ChatGPT横扫全球,开启了全球AI超级周期的序幕。高盛2025年2月的研究显示,自2022年11月ChatGPT面市以来,美国股市飙升50%,科技股市值增加13万亿美元,催生了美国历史上最强劲的牛市之一。而开源大模型DeepSeek引领的第二波浪潮,以更低成本实现接近GPT-4和Claude的高性能,加速了全社会对大模型的采用。到2025年2月,全球已有超过200家公司接入DeepSeek,涵盖互联网巨头、电信运营商、金融科技企业、车企及政府部门。

  澳鹏Appen全球高级副总裁、大中华及北亚区总经理田小鹏博士表示,与全球大模型更侧重通用性和多语言多语种模型泛化的模式不同,中国大模型更侧重"通用+垂直领域",这意味着中国大模型在未来行业应用场景、特定垂直领域创新方面独树一帜,也更在"局部领域"更容易实现 AI 垂类实践的突破,对特定行业和社会生产力的大幅快速提升。

  在DeepSeek等一系列 AI 大模型创新影响下,技术进步、应用生态、生产关系和生产力变革这三者正在形成闭环共振,形成从技术进步到生产力提升的"超级周期",其中包括了超级AI周期、超级经济周期以及激活的超级AI数据服务周期。Gartner在2025年2月发布预测,认为到2028年,中国企业对人工智能就绪型数据(特别是非结构化数据)的投资将达到2024年的20倍!

  在ChatGPT阶段,大模型的瓶颈已经从算力和算法推进到了数据;在DeepSeek阶段,高质量数据进一步成为大模型的"燃料"。2024年底,就在DeepSeek即将横扫全球前夕,中国国家发改委等部门发布了《关于促进数据标注产业高质量发展的实施意见》,引发了全社会对于数据标注的关注,迅速引爆了数据标注行业的热度,市场认为数据标注行业井喷在即。

  作为AI数据服务行业龙头企业,澳鹏Appen公司的2024年全年报显示,经调整后的公司年增长16%、2024年下半年大模型收入占28%。在澳鹏中国,大模型及大模型相关业务已经占据了营收的40%。澳鹏自2023年中旬推出大模型相关产品和服务,仅仅一年多的时间发展成为了第一大业务,用"爆发"形容并不为过。2024年,澳鹏中国全年实现了4.2亿人民币营收,其中大模型及大模型相关业务营收达到1亿人民币。

  虽然公司在2024年取得了跨越式发展,但澳鹏Appen全球高级副总裁、大中华及北亚区总经理田小鹏博士认为,以DeepSeek等大模型为代表的大模型红利才刚刚开始,AI数据服务行业将进入10-20年的景气周期,澳鹏中国将在技术、交付、安全和渠道等方向持续布局,其中的战略重点是技术和交付。而澳鹏作为AI数据服务行业的龙头,其面向未来十年超级周期的布局,也将影响整个行业的发展方向。

  技术和研发是澳鹏中国持续性战略投资的重要方向。田小鹏博士表示,技术是绝对生产力,未来5年,澳鹏中国将向研发再投入2-3亿元人民币,以确保公司在大模型超级周期中的持续竞争力,公司也将持续转型为算法辅助型、深化垂直领域的数据服务能力,同时通过人机协同模式提升数据标注的专业性和准确性。

  澳鹏中国研发负责人、产品和工程副总裁钱程介绍,公司目前80%以上的研发人员都参与了大模型相关的研发任务,主要研发方向包括面向大模型的数据服务平台、面向大模型的数据标注工具以及大模型相算法的研发和应用等。2025年,澳鹏中国将投入研发资源打造智能化成品数据集生产管理平台,通过自动化的数据标注、清洗挖掘和质量评估快速构建大规模高质量成品数据集,为大模型的模型训练提供高质量数据养料。

  此外,随着大模型应用向垂直领域的不断深入,澳鹏中国将结合自身在大模型和各垂直领域数据服务中积累的丰富经验,研发高精尖垂类数据标注平台,澳鹏中国计划在2025年上半年推出专业的大模型医疗数据标注平台和具身智能数据标注平台,进一步赋能垂直领域客户构建高质量模型训练数据。

  当前正处于超级周期的启动阶段,大模型发展迅猛且竞争激烈。许多AI数据标注项目具有实验性质,澳鹏需要迅速调整相关的平台和资源以适应不同的数据需求。钱程指出,大模型的发展,尤其在后训练阶段非常迅速,客户不断尝试新方法以优化效果。澳鹏团队与客户紧密合作,支持模型训练的数据需求,助力模型能力的不断提升。

  对于尝试性实验项目,澳鹏需要迅速构建数据处理工具和工作流程,采集和标注数据,并进行结果训练和验证。这需要一个灵活的平台工作流、自定义标注模板和敏捷的项目管理。澳鹏的大模型智能开发平台通过自定义模板引擎,能够在几分钟内快速配置数据标注模板,而定制化小型工具的开发则可在几天到一周内完成。

  钱程指出,客户需求快速迭代,创意层出不穷,澳鹏的产品研发团队为深度参与在这一快速发展的赛道而感到兴奋。一方面,他们积极跟进国内外大模型训练的技术变化;另一方面,与客户实时交流前沿发展趋势,共同探讨数据服务的构建方法。

  "以AI赋能AI"是澳鹏产品研发团队不断提升数据服务效率的宗旨,为了提升团队的生产力和效率,澳鹏在数据处理和生产管理中广泛应用大模型,替代传统算法。这不仅大幅提高了技术和工程团队的代码编写效率,还帮助数据交付部门提升了数据服务和项目管理的智能化水平。

  面向垂直领域的交付能力也是澳鹏的战略投资方向。继通用知识后,专业知识是大模型下一步的重点发展领域。澳鹏在已有垂直领域能力的基础上, 2024年开辟了金融、法律、音乐、多语种、文学、TTS、数学、医疗、代码等九个大模型垂直领域团队,专门负责开发和培养这些垂直领域的复合型人才,以及承担相应的数据服务项目。

  2024年,澳鹏在代码大模型领域取得显著增长,拥有120+全职技术人员覆盖主流编程语言,提供代码生成、调试等服务,业务扩展至能力评估、运维、测试等场景,团队规模翻倍,并持续积累高质量代码数据集,确保代码模型在多种编程场景和任务类型上的泛化能力。

  此外,澳鹏在大模型各垂类领域都拥有丰富的专业人才资源:在法律领域,拥有专业的法律人才,涵盖法律检索、庭审、风控体系建设等核心能力;多语言领域,团队覆盖200+语种,具备丰富的多语言项目交付经验;音乐领域,拥有500+兼职音乐专业人员支持编曲、标注、制谱等任务;TTS领域,拥有数十个国家TTS采集经验,录音棚覆盖全国主要城市;文学领域,团队成员均具备深刻的文学理解与鉴赏能力,支持跨领域多模态融合与创新、情感交互与智能推荐系统等领域大模型的发展……澳鹏凭借强大的专业团队和丰富经验,持续为大模型提供高质量数据支持。


责任编辑:小美
分享到:
0
【慎重声明】凡本站未注明来源为"前瞻科技网"的所有作品,均转载、编译或摘编自其它媒体,转载、编译或摘编的目的在于传递更多信息,并不代表本站赞同其观点和对其真实性负责。如因作品内容、版权和其他问题需要同本网联系的,请在30日内进行!