腾讯合并混元多模态与大语言模型部门,姚顺雨统管
大模型竞争进入全模态时代
腾讯在大模型赛道上的组织架构正在经历一次关键调整。7月24日,腾讯宣布将混元多模态模型部门与大语言模型部门合并,成立基础模型部,统一由腾讯首席AI科学家姚顺雨管理。
这次合并的意义不是简单的组织瘦身。2025年4月,腾讯把多模态和语言模型拆成两条独立赛道各自发展,这套「双轨制」运行了大约15个月。现在合回来,说明管理层判断:全模态融合的时机到了。
为什么这么说?因为行业趋势正在从「各模态独立训练」走向「跨模态联合训练」。文本、图像、音频、视频——如果让一个模型同时理解这些不同形式的信息,它的智能上限会比多个专业模型拼在一起更高。OpenAI的GPT-5系列已经在走这个方向,谷歌Gemini也是原生多模态架构。
数据也撑得起这个判断。腾讯7月上线的Hy3模型,总调用量较上一代增长超过68倍。在WorkBuddy自选模型用户中,选择Hy3的比例达到了60%。这说明市场对全模态模型的接受度正在快速爬升,腾讯需要集中火力往前推。
姚顺雨此前在多模态和大语言模型领域都有深厚积累,由他来统管这个新部门,有助于打破过去部门间的壁垒。在当前国内大模型竞争进入白热化阶段的大背景下——各家都在卷参数、卷上下文、卷价格——腾讯选择了一条不太一样但可能更根本的路:不是在单一能力上做到极致,而是让模型天生就能理解和生成多种形式的内容。
这次合并还有一个容易忽视的背景:腾讯在AI领域一直走的是「务实路线」,不追求首发、不抢风头,但每次出手都有明确的落地场景。Hy3的爆发式增长说明这路线走得通。把分散的研发力量集中到一个部门,意味着腾讯正在把AI从一个「探索性项目」升级为核心战略级投入。
对普通用户来说,这个调整短期内可能感受不到什么变化。但长远看,一个真正「全模态」的腾讯混元——能同时看懂图片、听懂语音、写出文章、生成视频——才是这场AI竞赛里最值得关注的那个变量。