
这是自 2025 年 12 月姚顺雨空降腾讯以来,混元体系进行的又一次深层次整合。腾讯方面表示,此次合并是为了进一步提升模型研发和协同效率,探索全模态模型的智能上限。
回顾过去半年,姚顺雨对腾讯 AI 体系的重塑可谓大刀阔斧。
2025 年 12 月,他出任腾讯 "CEO/ 总裁办公室 " 首席 AI 科学家,同时兼任 AI Infra 部、大语言模型部负责人。2026 年 1 月底,混元启动底层基础设施全面重建,涵盖预训练、强化学习、数据体系和评估体系。3 月,腾讯撤销成立近十年的 AI Lab,相关研发人员部分并入大语言模型部。如今,大语言模型与多模态两大部门合并,混元在组织层面正式完成向 " 全模态大一统 " 的最后一跃。
与此同时,围绕混元体系的人员变动自 2026 年以来持续进行。
7 月初,前 OpenAI 研究员、麻省理工学院博士田永龙加入腾讯大语言模型部,后续将参与视觉语言模型(VLM)相关研发。公开资料显示,田永龙本科毕业于清华大学,曾在谷歌 Research、谷歌 DeepMind 任职,2024 年 10 月入职 OpenAI 担任技术研究员,聚焦机器视觉与多模态表征学习。他与姚顺雨既是清华本科校友,也是 OpenAI 同期共事的研究员。
与此同时,有媒体报道称,混元多模态理解负责人胡瀚近期提出离职创业,其职位将由田永龙接替。胡瀚此前担任微软亚洲研究院视觉计算组首席研究员,2025 年初加入腾讯后负责视觉大模型研究,随后加入大语言模型部旗下的 "Frontier" 前沿技术研究组。据了解,他还曾承担世界模型的研发工作。
此外,今年 2 月,原新加坡 SeaAI 首席研究科学家、清华博士庞天宇也加入腾讯混元团队,担任首席研究科学家,主攻大模型训练优化。腾讯同时力推 " 青云计划 ",面向全球招募 AI 大模型、多模态、基础架构等领域人才,并提出顶级薪酬和定制化培养方案。
目前,腾讯混元以大语言模型为基础,已构建了图像、视频、语音、3D 生成模型等完整的模型矩阵。
值得一提的是,姚顺雨入职后交出的首份完整 " 答卷 " ——大语言模型 Hy3,近期表现不俗。数据显示,发布一周后,Hy3 总调用量较上一代模型(Hy2)增长超 68 倍,WorkBuddy 自选模型的用户中,选择 Hy3 的占比达到 60%。
此外,混元多模态模型也在持续进化。4 月,腾讯发布并开源的混元 3D 世界模型 2.0(Hy World 2.0)。截至目前,混元 3D 系列模型的社区下载量超过 300 万,混元图像模型 3.0 在 LMArena 榜单上也位居国内开源模型第一。
从基础设施重建到组织架构整合,从姚顺雨空降、AI Lab 撤销到田永龙入职、胡瀚离职,腾讯混元用 7 个月时间完成了从顶层到中层、从组织到人才的全方位重构。随着基础模型部的成立,姚顺雨治下的腾讯 AI 能否在 " 全模态 " 赛道实现弯道超车,《科创板日报》将密切关注。