腾讯混元大语言模型与多模态团队合并,开启AI新篇章
近日,腾讯宣布了一项重磅消息:其混元多模态模型部门与大语言模型部门正式合并,成立全新的基础模型部,统一由腾讯首席AI科学家姚顺雨管理。这一举措旨在提升模型研发和协同效率,探索全模态模型的智能上限。
作为腾讯在AI领域的重要布局,混元系列模型自推出以来便备受关注。基于大语言模型的基础,腾讯混元构建了涵盖图像、视频、语音及3D生成模型的完整矩阵。特别是7月正式上线的Hy3大语言模型,其智能水平显著优于同尺寸模型,并比肩参数规模2-5倍的旗舰模型。值得一提的是,Hy3在上线仅一周后,总调用量较上一代模型Hy2增长了超过68倍,显示出其强大的市场接受度。在WorkBuddy/CodeBuddy等多个业务中,选择Hy3的用户占比达到了60%,这无疑为其未来的发展奠定了坚实的基础。
此外,混元多模态模型也在不断进化。4月发布并开源的混元3D世界模型2.0(HyWorld2.0),能够根据文字、图片和视频等不同类型输入,自动生成、重建和模拟3D世界,并支持多格式3D资产导出,极大地便利了游戏开发者的工作流程。混元3D系列模型的社区下载量已超过300万,反映出其在行业中的广泛认可。
在姚顺雨的带领下,腾讯正在全面升级其大模型研发架构,成立了AIInfra部、AIData部及数据计算平台部,以强化大模型的研发体系与核心能力。姚顺雨不仅担任“CEO/总裁办公室”首席AI科学家,还兼任AIInfra部和大语言模型部负责人,向腾讯总裁刘炽平及技术工程事业群总裁卢山汇报。
姚顺雨的背景同样引人瞩目,他本科毕业于清华大学姚班,并获得普林斯顿大学计算机科学博士学位,曾在2024年加入OpenAI,参与智能体产品的开发。他在语言智能体与现实世界交互方面的研究,提出了ReAct方法,首创了“推理—行动”结合的智能体范式,受到学术界与工业界的广泛认可。
此次部门合并不仅是腾讯AI战略的重要一环,也为未来的多模态模型发展指明了方向。随着技术的不断进步,腾讯希望通过更高效的研发体系,推动AI技术的应用与创新,最终实现更智能化的全模态交互体验。