《科创板日报》7月24日讯 近日,腾讯宣布对混元大模型业务群进行重大组织架构调整,将混元多模态模型部门与大语言模型部门合并,成立“基础模型部”,统一由腾讯首席AI科学家姚顺雨管理。
这是自2025年12月姚顺雨空降腾讯以来,混元体系进行的又一次深层次整合。腾讯方面表示,此次合并是为了进一步提升模型研发和协同效率,探索全模态模型的智能上限。
回顾过去半年,姚顺雨对腾讯AI体系的重塑可谓大刀阔斧。
2025年12月,他出任腾讯“CEO/总裁办公室”首席AI科学家,同时兼任AI Infra部、大语言模型部负责人。2026年1月底,混元启动底层基础设施全面重建,涵盖预训练、强化学习、数据体系和评估体系。3月,腾讯撤销成立近十年的AI Lab,相关研发人员部分并入大语言模型部。如今,大语言模型与多模态两大部门合并,混元在组织层面正式完成向“全模态大一统”的最后一跃。
与此同时,围绕混元体系的人员变动自2026年以来持续进行。
7月初,前OpenAI研究员、麻省理工学院博士田永龙加入腾讯大语言模型部,后续将参与视觉语言模型(VLM)相关研发。公开资料显示,田永龙本科毕业于清华大学,曾在谷歌Research、谷歌DeepMind任职,2024年10月入职OpenAI担任技术研究员,聚焦机器视觉与多模态表征学习。他与姚顺雨既是清华本科校友,也是OpenAI同期共事的研究员。
与此同时,有媒体报道称,混元多模态理解负责人胡瀚近期提出离职创业,其职位将由田永龙接替。胡瀚此前担任微软亚洲研究院视觉计算组首席研究员,2025年初加入腾讯后负责视觉大模型研究,随后加入大语言模型部旗下的“Frontier”前沿技术研究组。据了解,他还曾承担世界模型的研发工作。
此外,今年2月,原新加坡SeaAI首席研究科学家、清华博士庞天宇也加入腾讯混元团队,担任首席研究科学家,主攻大模型训练优化。腾讯同时力推“青云计划”,面向全球招募AI大模型、多模态、基础架构等领域人才,并提出顶级薪酬和定制化培养方案。
目前,腾讯混元以大语言模型为基础,已构建了图像、视频、语音、3D 生成模型等完整的模型矩阵。
值得一提的是,姚顺雨入职后交出的首份完整“答卷”——大语言模型 Hy3,近期表现不俗。数据显示,发布一周后,Hy3 总调用量较上一代模型(Hy2)增长超 68 倍,WorkBuddy 自选模型的用户中,选择Hy3 的占比达到 60%。
此外,混元多模态模型也在持续进化。4月,腾讯发布并开源的混元3D世界模型 2.0(Hy World 2.0)。截至目前,混元3D系列模型的社区下载量超过300万,混元图像模型3.0在LMArena 榜单上也位居国内开源模型第一。
从基础设施重建到组织架构整合,从姚顺雨空降、AI Lab撤销到田永龙入职、胡瀚离职,腾讯混元用7个月时间完成了从顶层到中层、从组织到人才的全方位重构。随着基础模型部的成立,姚顺雨治下的腾讯AI能否在“全模态”赛道实现弯道超车,《科创板日报》将密切关注。