首页 > 教程攻略 > ai资讯 >姚顺雨领军,腾讯合并大语言模型和多模态团队

姚顺雨领军,腾讯合并大语言模型和多模态团队

来源:互联网 时间:2026-07-25 08:06:22

这几天,腾讯那边搞了个大动作——把混元多模态模型部门和大语言模型部门合并了,统一成立一个基础模型部,由首席AI科学家姚顺雨带队。这事儿的逻辑很清晰:把两个团队的力量拧成一股绳,从底层到上层打通,目标直指全模态模型的智能上限。

姚顺雨(右) 资料图

这次合并,意味着从2025年4月开始实行的大语言、多模态双团队并行研发模式,正式画上句号。官方的说法是,整合之后,研发和协同效率能提升,而且能更专注地探索全模态模型的上限。这背后其实透露了一个信号:腾讯在AI这条道上,不再满足于“两条腿走路”,而是要把所有资源往一个方向使劲儿。

说到姚顺雨,他2025年9月从OpenAI低调加入,12月就担任了首席AI科学家,统筹混元大语言模型的研发。入职不到一年,他推动混元把底层基础设施重建了一遍。现在,混元已经形成一套以语言模型为核心的完整架构,覆盖图像、视频、语音、3D生成,基本上能想到的模态都有了。

7月初,混元正式发布并开源了大语言模型Hy3。这个模型采用的是MoE架构,总参数295B,激活参数21B,相比4月发布的preview版本,智能体和代码能力提升了20%到30%。在同等参数规模下,它的性能测评领先,甚至可以比肩参数规模是它2到5倍的旗舰模型。这个成绩,放在行业内挺能打的。

Hy3已经接入到WorkBuddy、CodeBuddy、元宝、Marvis、ima等多个业务,API同步上线了腾讯云TokenHub和多个海外平台。发布首周,Hy3总调用量比上一代Hy2增长了超过68倍;在WorkBuddy自选模型的用户中,选择Hy3的占比达到了60%。这个数字说明,市场对它的认可度相当高。

多模态这边,腾讯4月发布并开源了混元3D世界模型2.0(Hy World 2.0)。它支持文本、图片、视频等多类型输入,能自动生成、重建和模拟3D世界,还能兼容多种格式的3D资产导出,跟现有的游戏工作流无缝对接。社区下载量已经超过300万。另外,混元图像模型3.0在LMArena榜单中,排名国内开源模型第一。

多模态业务的发展,也带动了人才方面的变动。7月8日,前OpenAI研究员、姚顺雨的前同事田永龙加入了腾讯大语言模型部。田永龙在视觉模型和多模态表征学习方面的研究,对行业影响不小。他的加入,预计能为下一代混元多模态模型提供技术支撑。这也让人对后续的进展多了一些期待。