腾讯合并多模态与大语言模型部门,成立基础模型部探索全模态智能上限
7月24日,据新浪科技报道,腾讯近日宣布将混元多模态模型部门与大语言模型部门合并,成立基础模型部,统一由腾讯首席AI科学家姚顺雨管理,以进一步提升模型研发和协同效率,探索全模态模型的智能上限。
此次合并是大模型赛道从“单点突破”走向“系统整合”趋势的一个缩影。腾讯混元此前已构建了涵盖图像、视频、语音、3D生成模型的完整模型矩阵,但图像模型团队与语言模型团队在研发路径、数据来源和工程习惯上长期存在差异。新成立的基础模型部旨在打通这些技术壁垒,从架构层面更高效地整合语言、视觉、3D等多模态数据,探索单一模型架构统一处理多模态任务的研发路径。
姚顺雨的履历为这一整合增添了技术可信度。他本科毕业于清华大学姚班,获普林斯顿大学计算机科学博士学位,2024年加入OpenAI并参与智能体产品Operator与Deep Research的开发,其提出的ReAct方法首创“推理—行动”结合的智能体范式,被学术界与工业界广泛采纳。2025年12月,腾讯升级大模型研发架构,姚顺雨出任首席AI科学家,向腾讯总裁刘炽平汇报。
在这一组织调整的同期,腾讯混元在模型层面也取得了可量化的进展。7月正式上线的大语言模型Hy3展现出比肩参数规模2-5倍旗舰模型的智能水平,已在WorkBuddy、CodeBuddy、元宝、Marvis、ima等多个业务接入。发布一周后,Hy3总调用量较上一代Hy2增长超68倍,在OpenRouter全球大模型调用量总榜排名第一,WorkBuddy自选模型用户中Hy3占比达60%。在4月发布并开源的混元3D世界模型2.0社区下载量超过300万,混元图像模型3.0在LMArena榜单上居国内开源模型第一。
从组织架构到模型能力,腾讯正试图通过“全模态”架构来回应AI行业竞争的新格局——正如姚顺雨在内部沟通中所说,全模态模型的智能上限远高于单模态或分立模态的现有架构,而组织统一是实现这一目标的第一步。