# 腾讯大模型团队再调整：成立基础模型部，姚顺雨职责扩大 - 新浪财经

*Источник: 新浪财经*
*Дата: 2026-07-24*
*Язык: zh*

**Кратко:** 21世纪经济报道记者 彭新
7月23日下午，腾讯内部通知称，成立基础模型部，合并大语言模型部和多模态模型部，相关业务及团队全部并入新部门。腾讯首席AI科学家姚顺雨兼任基础模型部负责人，向技术工程事业群（TEG）总裁卢山汇报。
此外，腾讯未公布原混元多模态模型部负责人薄列峰的去向，且近期外界传出混元多模态理解负责人胡瀚离职的消息，前OpenAI研究员田永龙将接替胡瀚的工作，但腾讯对此没有回应。
合并大语言模型和多模态模型部门后，姚顺雨职责扩大，腾讯称，这一变化将进一步提升模型研发和协同效率，助力探索全模态模型智能上限。
这意味着，腾讯混元自2025年4月拆分大语言模型部和多模态模型部后形成的算法研发“双轨制”，运行约15个月后重新合并。此次调整将语言、视觉、语音、3D等模型研发纳入统一的基础模型架构，由姚顺雨统筹技术路线、算力资源和产品协同。
依托强势的游戏业务，多模态被认为是腾讯相对具备优势的领域。腾讯混元多模态模型部的研发方向涵盖图像、视频、语音、3D生成及多模态理解，并依托腾讯在游戏、内容、社交和企业服务等领域的业务场景，推动相关能力用于游戏资产生成、图片与视频创作等环节，通过腾讯云向外部客户开放。
在具体成果方面，混元图像3.0图生图版本已接入腾讯元宝；混元3D世界模型2.0于2026年4月发布并开源，腾讯介绍，该模型是一个多模态世界模型，能够理解文字、图片、视频等不同类型输入，自动生成、重建和模拟 3D 世界，能与现有的游戏工作流无缝对接，快速生成游戏地图和关卡原型；此外，图像设计智能体“妙境Miora”则于7月22日上线。
这也是腾讯大模型团队继今年3月之后的又一次重大架构调整。腾讯当时撤销了AI实验室（AI Lab），保留产学研合作中心，部分人员调整至混元团队，向姚顺雨汇报，多模态部负责人向卢山汇报。
在姚顺雨领导下，腾讯混元重建了预训练和强化学习的基础设施，并确立了模型追求实用性的原则。7月6日，腾讯发布其基座模型混元Hy3，Hy3定价主打性价比，较前代版本有所下降。其定价为输入1元/百万tokens，该价格较预览版下降0.2元/百万tokens；输出价格保持在4元/百万tokens；输入命中缓存价格则从预览版的0.4元/百万tokens降至0.25元/百万tokens。
从现有表现看，Hy3的能力提升主要来自基础设施和训练数据层面的统一，而非不同模态架构的直接融合。据腾讯介绍，其推理效率提升约40%，幻觉率由12.5%降至5.4%。
与OpenAI、谷歌将文本、图像、音频乃至视频能力逐步整合进同一基础模型的路径不同，从腾讯已披露的产品形态来看，Hy3主要承担文本推理与Agent任务，图像、视频和3D等能力则由不同的专用模型分别完成，再通过智能体或产品流程实现协作。
“这个世界还有很多空间没有被填满，多模态、具身智能，很多很多新的事情都在发生，或者刚刚发生，所以从这个角度来说，我们认为下半场刚刚开始。” 提及多模态，姚顺雨在6月5日同腾讯云与智慧产业事业群CEO汤道生对谈时称，自己加入腾讯正是因为其场景和产品丰富，模型能获得真实的输入和上下文。
姚顺雨进一步认为，AI下半场的关键，是建立一个长期面向AGI的组织，即在基础模型、产品落地和前沿研究三个方向形成均衡布局。姚顺雨介绍，这样的组织在基础模型层需要夯实预训练和后训练能力，产品层需要推动技术真正为用户和社会创造价值，前沿研究则要持续探索新的研究范式与机会，构建出一个三者非常均衡的“三角形”组织。

21世纪经济报道记者 彭新
7月23日下午，腾讯内部通知称，成立基础模型部，合并大语言模型部和多模态模型部，相关业务及团队全部并入新部门。腾讯首席AI科学家姚顺雨兼任基础模型部负责人，向技术工程事业群（TEG）总裁卢山汇报。
此外，腾讯未公布原混元多模态模型部负责人薄列峰的去向，且近期外界传出混元多模态理解负责人胡瀚离职的消息，前OpenAI研究员田永龙将接替胡瀚的工作，但腾讯对此没有回应。
合并大语言模型和多模态模型部门后，姚顺雨职责扩大，腾讯称，这一变化将进一步提升模型研发和协同效率，助力探索全模态模型智能上限。
这意味着，腾讯混元自2025年4月拆分大语言模型部和多模态模型部后形成的算法研发“双轨制”，运行约15个月后重新合并。此次调整将语言、视觉、语音、3D等模型研发纳入统一的基础模型架构，由姚顺雨统筹技术路线、算力资源和产品协同。
依托强势的游戏业务，多模态被认为是腾讯相对具备优势的领域。腾讯混元多模态模型部的研发方向涵盖图像、视频、语音、3D生成及多模态理解，并依托腾讯在游戏、内容、社交和企业服务等领域的业务场景，推动相关能力用于游戏资产生成、图片与视频创作等环节，通过腾讯云向外部客户开放。
在具体成果方面，混元图像3.0图生图版本已接入腾讯元宝；混元3D世界模型2.0于2026年4月发布并开源，腾讯介绍，该模型是一个多模态世界模型，能够理解文字、图片、视频等不同类型输入，自动生成、重建和模拟 3D 世界，能与现有的游戏工作流无缝对接，快速生成游戏地图和关卡原型；此外，图像设计智能体“妙境Miora”则于7月22日上线。
这也是腾讯大模型团队继今年3月之后的又一次重大架构调整。腾讯当时撤销了AI实验室（AI Lab），保留产学研合作中心，部分人员调整至混元团队，向姚顺雨汇报，多模态部负责人向卢山汇报。
在姚顺雨领导下，腾讯混元重建了预训练和强化学习的基础设施，并确立了模型追求实用性的原则。7月6日，腾讯发布其基座模型混元Hy3，Hy3定价主打性价比，较前代版本有所下降。其定价为输入1元/百万tokens，该价格较预览版下降0.2元/百万tokens；输出价格保持在4元/百万tokens；输入命中缓存价格则从预览版的0.4元/百万tokens降至0.25元/百万tokens。
从现有表现看，Hy3的能力提升主要来自基础设施和训练数据层面的统一，而非不同模态架构的直接融合。据腾讯介绍，其推理效率提升约40%，幻觉率由12.5%降至5.4%。
与OpenAI、谷歌将文本、图像、音频乃至视频能力逐步整合进同一基础模型的路径不同，从腾讯已披露的产品形态来看，Hy3主要承担文本推理与Agent任务，图像、视频和3D等能力则由不同的专用模型分别完成，再通过智能体或产品流程实现协作。
“这个世界还有很多空间没有被填满，多模态、具身智能，很多很多新的事情都在发生，或者刚刚发生，所以从这个角度来说，我们认为下半场刚刚开始。” 提及多模态，姚顺雨在6月5日同腾讯云与智慧产业事业群CEO汤道生对谈时称，自己加入腾讯正是因为其场景和产品丰富，模型能获得真实的输入和上下文。
姚顺雨进一步认为，AI下半场的关键，是建立一个长期面向AGI的组织，即在基础模型、产品落地和前沿研究三个方向形成均衡布局。姚顺雨介绍，这样的组织在基础模型层需要夯实预训练和后训练能力，产品层需要推动技术真正为用户和社会创造价值，前沿研究则要持续探索新的研究范式与机会，构建出一个三者非常均衡的“三角形”组织。

[Оригинал](https://t.cj.sina.com.cn/articles/view/1651428902/626ece2602001hmnk)