騰訊合併混元多模態與大語言模型部門,姚順雨統管

大模型競爭進入全模態時代

2026-07-25 16:34

騰訊在大模型賽道上的組織架構正在經歷一次關鍵調整。7月24日,騰訊宣佈將混元多模態模型部門與大語言模型部門合併,成立基礎模型部,統一由騰訊首席AI科學家姚順雨管理。

這次合併的意義不是簡單的組織瘦身。2025年4月,騰訊把多模態和語言模型拆成兩條獨立賽道各自發展,這套「雙軌制」執行了大約15個月。現在合回來,說明管理層判斷:全模態融合的時機到了。

為什麼這麼說?因為行業趨勢正在從「各模態獨立訓練」走向「跨模態聯合訓練」。文字、影象、音訊、影片——如果讓一個模型同時理解這些不同形式的資訊,它的智慧上限會比多個專業模型拼在一起更高。OpenAI的GPT-5系列已經在走這個方向,谷歌Gemini也是原生多模態架構。

資料也撐得起這個判斷。騰訊7月上線的Hy3模型,總呼叫量較上一代增長超過68倍。在WorkBuddy自選模型使用者中,選擇Hy3的比例達到了60%。這說明市場對全模態模型的接受度正在快速爬升,騰訊需要集中火力往前推。

姚順雨此前在多模態和大語言模型領域都有深厚積累,由他來統管這個新部門,有助於打破過去部門間的壁壘。在當前國內大模型競爭進入白熱化階段的大背景下——各家都在卷引數、捲上下文、卷價格——騰訊選擇了一條不太一樣但可能更根本的路:不是在單一能力上做到極致,而是讓模型天生就能理解和生成多種形式的內容。

這次合併還有一個容易忽視的背景:騰訊在AI領域一直走的是「務實路線」,不追求首發、不搶風頭,但每次出手都有明確的落地場景。Hy3的爆發式增長說明這路線走得通。把分散的研發力量集中到一個部門,意味著騰訊正在把AI從一個「探索性專案」升級為核心戰略級投入

對普通使用者來說,這個調整短期內可能感受不到什麼變化。但長遠看,一個真正「全模態」的騰訊混元——能同時看懂圖片、聽懂語音、寫出文章、生成影片——才是這場AI競賽裡最值得關注的那個變數。