騰訊混元3D

騰訊自研的多模態3D內容生成系統

深度報告

  • 騰訊混元3D是騰訊自研的多模態3D內容生成系統,覆蓋3D資產生成和3D世界生成兩大方向。資產生成方面已迭代至2.5版本,支援文生3D、圖生3D、PBR材質生成等九大功能模組;世界生成方面於2026年4月釋出HY-World2.0,可從文字或圖片一鍵生成可互動的3D場景。該產品採用「開源+雲服務」雙軌模式,基礎模型完全開源,企業級應用透過騰訊雲API按呼叫付費。在多項基準評測中,混元3D的綜合表現領先於Tripo3D、Meshy等競品。

  • 騰訊混元3D由騰訊混元團隊開發,隸屬於騰訊混元大模型體系。該團隊同時負責混元語言模型和混元影象模型,是騰訊AI戰略的核心技術力量。 產品發展脈絡清晰:2025年1月推出混元3D 2.0並開源,同年3月釋出Turbo版本採用自研FlashVDM架構實現秒級生成;2025年6月迭代至2.5版本,引入100億引數的LATTICE形狀模型和PBR物理渲染材質生成;2025年10月推出混元世界模型1.0,開始從單物體生成向場景級生成擴充套件;2026年3月開源WorldCompass強化學習後訓練框架;最終在2026年4月16日正式釋出並開源混元3D世界模型2.0(HY-World2.0)。 在行業格局上,騰訊混元3D面臨來自多個方向的競爭:谷歌的Genie 3和Project Genie、李飛飛團隊World Labs(2025年2月完成10億美元融資)、Meta的世界模型研究,以及國內位元組跳動Tripo3D和Meshy等3D生成工具。騰訊的策略是透過開源降低使用門檻,同時以雲服務API實現商業變現,形成「技術普惠-生態培育-商業變現」的完整閉環。

  • 混元3D的產品功能可劃分為兩大主線:3D資產生成和3D世界生成。 3D資產生成方面,最新版本2.5提供九大功能模組,包括文生3D(支援零引數模式)、單圖轉3D、低多邊形建模、骨骼動畫生成、手繪草圖轉換、智慧紋理對映、數字人建立、輕量級遊戲開發模板和視覺化節點編輯器。其中文生3D速度約62秒,相比2.0版本生成速度提升65%,模型精度提升40%,拓撲最佳化錯誤率降低72%。2.5版本最突出的升級是引入100億引數的LATTICE形狀模型,能準確捕捉手指數量、腳踏車輻條等精細結構;同時首次支援PBR物理渲染材質生成,透過反照率、粗糙度、金屬度三通道並行協同機制,實現高達768x768解析度的材質貼圖輸出。 3D世界生成方面,HY-World2.0於2026年4月釋出,實現了從「生成內容」到「生成體驗」的跨越。技術架構分為四步流程:先透過HY-Pano 2.0從文字或圖片生成360度全景圖,再由WorldNav進行空間語義理解和漫遊軌跡規劃,然後經HY-WorldStereo進行世界擴充套件和細節保持,最後由HY-WorldMirror 2.0進行世界合成並輸出3DGS或Mesh格式。實測顯示,影片方式重建效果明顯優於照片方式——21秒環繞影片可較準確還原4平方米空間,而10張照片重建則容易出現傢俱重疊等問題。 與主要競品對比,混元3D在綜合能力上表現突出。CSDN博主進行了上百組對照實驗後發現:文生3D方面混元3D速度最快(62秒 vs Tripo3D的195秒、Meshy的240秒),在複雜物件如「寶石項鍊」生成中表現最佳;圖生3D方面混元3D在人物手部比例誤差控制上最優(15%以內 vs 競品的25-30%);材質生成方面混元3D的寶石切割吻合度達82%,高於Meshy的59%。不過Tripo3D在專業引數調節和多圖融合上仍有優勢,適合專業建模師使用。

  • 混元3D採用「開源+雲服務」的雙軌商業模式。基礎模型在GitHub和Hugging Face完全開源,開發者可免費部署使用;企業級應用則透過騰訊雲「混元生3D」服務提供API呼叫。 API定價採用積分制。新使用者首次開通可領取100積分免費額度(有效期1年),每日線上體驗平臺提供約10次免費生成機會。付費分為預付費和後付費兩種模式:預付費積分包從100元/1000積分到9000元/100000積分不等,積分單價隨購買量遞減(0.10元至0.09元);後付費統一按0.12元/積分日結算。 具體到功能呼叫,混元生3D專業版基礎生成消耗20積分/次(約2-2.4元),LowPoly模式25積分/次,附加PBR材質需額外10積分。增值功能方面,智慧拓撲50積分/次、紋理生成30積分/次、3D人物生成30積分/次。併發限制方面,專業版預設3個併發,極速版及增值功能預設1個併發,如需擴容可購買併發疊加包(30000元/併發/月)。

  • 正面評價集中在幾個方面。許多使用者認為混元3D的生成速度和綜合能力在同類產品中表現突出,尤其是文生3D的62秒響應速度獲得好評。2.5版本的PBR材質生成質量受到專業使用者的認可,在科技行者的評測中獲得了72%的使用者偏好率。開源策略也收穫了開發者社群的積極反饋,GitHub上已有社群成員貢獻了Windows安裝工具和ComfyUI支援外掛。騰訊地圖基於混元3D生成的導航車標,使用者點選率提升了210%,驗證了其在商業場景中的實際價值。 負面反饋主要集中在世界重建功能上。實測顯示照片重建方式(10張照片)效果不夠準確,容易出現傢俱重疊和空間錯位問題,評測者建議改用影片拍攝方式。此外,所有AI 3D工具在全身人像面部細節、透明材質折射率計算、動畫關鍵幀流暢度等方面仍存在改進空間。有使用者反映線上體驗平臺的免費額度相對有限,對於高頻使用場景成本可能偏高。2026年3月騰訊雲上調了混元大語言模型的API價格(漲幅達463%),也引發了部分開發者對3D服務未來漲價的擔憂。

  • 科技媒體普遍將混元3D視為中國在AI 3D生成領域的重要突破。消費者報道的實測文章指出,HY-World2.0的核心優勢在於可與遊戲工作流無縫對接,生成的3D場景可直接匯入Unity和UE引擎進行二次編輯。科技行者評價2.5版本的LATTICE形狀模型「重新定義了AI 3D生成的精度上限」。網易號文章分析認為騰訊混元3D的進化路徑代表了中國AI從「引數競賽」轉向「落地變現」的行業拐點。 在學術界,混元3D的論文在arXiv上獲得廣泛關注。WorldCompass作為業界首個面向世界模型的強化學習後訓練框架,被視為世界模型訓練方法論的重要創新。

  • 2026年3月騰訊雲對混元大語言模型API價格進行大幅上調(漲幅463%),雖然這次調價不直接涉及3D服務,但引發了開發者對3D API未來定價策略的擔憂。混元3D目前仍處於快速迭代期,版本更新頻繁(從2.0到2.5再到World 2.0),API介面和功能模組可能存在不穩定性。世界重建功能對輸入資料質量要求較高,普通使用者缺乏專業拍攝經驗,可能導致生成效果不理想。在3D資產生成的面部細節、透明材質處理等方面,混元3D與專業建模軟體仍有差距,短期內難以完全替代傳統3D建模工作流。

  • 混元3D適合遊戲開發者快速生成場景原型和關卡設計,影視製作團隊進行虛擬場景概念設計,電商團隊製作360度商品展示模型,以及建築師和室內設計師進行空間預覽。對於個人創作者和3D愛好者,混元3D的線上體驗平臺提供了低門檻的入門方式。 如果需要更專業的引數控制和多圖融合能力,可以搭配Tripo3D使用;如果主要用於移動端輕量化場景,Meshy是更經濟的選擇。普通使用者在體驗世界重建功能時,建議優先使用影片拍攝方式而非照片方式,以獲得更準確的空間還原效果。

  • 騰訊混元3D憑藉開源生態、全面的功能覆蓋和持續快速迭代,已成為AI 3D生成領域最具競爭力的產品之一。從單物體資產生成到場景級世界生成,混元3D正在構建一個從「3D資產」到「3D世界」的完整創作工具鏈。對於開發者和創作者而言,它是目前最值得關注的AI 3D工具之一。

使用者評論

  • 頭像
    a1185u4
    騰訊雲API按積分計費,0.375一個模型還送兩百免費額度,拿來跑批次電商展示比自己搭管線划算太多,中小商家真該試試。

  • 頭像
    Christopher.Thomas_77
    批次生成一百個遊戲寶箱實測四十五分鐘搞定,成功率九成四,平均二十八秒一個還帶自動UV和LOD。小團隊養不起3D美術的,這個功能直接把成本打下來了,資源可以全砸在核心玩法和美術風格上,這才是真生產力工具。

  • 頭像
    Jeremy_Cook_Plus12
    貓片變3D模型,又cursed又上頭。

  • 頭像
    Christine.RiveraIII568
    自動四邊形重拓撲真良心,關節位置的佈線處理得比我自己拆的還整齊。

  • 頭像
    Maria_Edwards
    紋理偶爾會有接縫和模糊,我用Motif修一下能拉到準專業級,整體瑕不掩瑜,免費額度擺在那兒還要啥腳踏車。

  • 頭像
    Amanda.MooreIII
    拿它做工業設計的草圖驗證,畫了把椅子手繪稿,不到三分鐘拿到可3D列印的模型,還能指定「高120座深45」這種真實尺寸,對人體工學不合理的部分它還會智慧最佳化。傳統流程一個熟手要兩三個小時,這效率真沒法比。

  • 頭像
    Angela.Hughes520
    國際版到現在還沒上3.1,新功能全在中文版,海外使用者體驗割裂。

  • 頭像
    iSaidVaa_pro
    Arena排第二,離Tripo就差一口氣。

  • 頭像
    82zal31
    匯出的格式夠全,GLB、OBJ、FBX、USD都支援,面數也從五萬壓到兩萬以內,丟進Unity基本不用怎麼修就能用,省了下游一大堆活。

  • 頭像
    miDIA
    七月的那次大版本升級是真有用,多檢視一致架構把轉角度變形的毛病治好了七成,現在旋轉120度紋理幾乎不變形。還加了區域性重生成,選中桌腿單獨改周圍不動,迭代成本從整重生成降到微調,這個對實際設計太關鍵了。

  • 頭像
    TheresaVasquez_2023
    每天20次免費額度,prototyping 基本上管夠。

  • 頭像
    JordanNguyen5207
    吐槽一個,有機形態被它過度平滑了,想做個帶樹葉的小樹,結果葉子細節全磨沒了,硬表面手錶倒是驚豔。官方那個平滑處理對角色和植物不太友好,做角色建議後期進Blender補細節。

  • 頭像
    JulieHenderson520
    開源的,Apache 2.0,商用沒包袱。

  • 頭像
    Kathryn_Hicks515
    幫電商客戶批次搞了五十多個商品3D展示,混元3D大概五十二秒一個,成功率九成六,錶盤刻度和錶帶紋理都還原得挺像。中文Prompt理解確實比Tripo和Meshy強,寫「陶瓷表圈矽膠錶帶」它真能聽明白,這點對國內團隊太友好了。

  • 頭像
    Billy_FosterZ
    做獨立遊戲用混元3D出原型太省事了,丟幾張概念圖進去,出來的低模雖然要進Blender清理一下佈線,但比從零建模快了不止十倍,早期驗證玩法完全夠用。

  • 頭像
    ChristineMurray_2024
    單圖出3D真的離譜,上傳手辦照片幾十秒就拿到能用的模型了。

  • 頭像
    Natalie.Brown_2022
    混元3D這免費的額度太香了。

  • 頭像
    1r6ya4m
    開源大廠還是騰訊啊,谷歌的Genie到現在還藏著掖著,混元直接把世界模型開源了

  • 頭像
    松濤705
    一句話就能生成3D世界這個概念太瘋狂了,之前用Genie 3只能生成影片,沒法匯出模型。HY-World 2.0直接出Mesh和3DGS,匯入Unity就能用,這才是遊戲開發真正需要的東西。

  • 頭像
    SRodriguezQ
    試了下世界重建功能,用手機錄了個21秒的環繞影片,還原出來的房間佈局還挺準的。但用照片拍就不太行,10張照片出來的效果傢俱都疊在一起了

  • 頭像
    CHwhi
    作為獨立遊戲開發者,之前做關卡原型最少要一週,現在用HY-World2.0一句話生成基礎場景然後匯入UE微調,效率提升太明顯了。雖然細節還要手工打磨,但起碼不用從零開始搭了

  • 頭像
    ERobinson_883
    有人試過把生成的3D場景匯入Unity做物理碰撞嗎?官方說支援但我本地跑起來有些模型的碰撞體對不上

  • 頭像
    emBER
    4月16號剛釋出就去體驗了,全景圖生成效果很驚豔,輸入一張風景照就能360度延展。但世界擴充套件那步有時候會出現幾何失真,牆角的地方偶爾會穿模

  • 頭像
    Sophia_Cox007
    騰訊這是要把3D建模師幹失業的節奏?不過說實話離真正的生產級還早,面部細節和透明材質的處理還是拉胯

  • 頭像
    Carl.Coleman_X81
    等混元3D世界模型2.0等了好久了,從1.0到1.5到現在的2.0,進步確實快。角色冒險模式真的能讓你在生成的3D場景裡走來走去,有種在玩沙盒遊戲的感覺

  • 頭像
    17jkraa43
    混元3D這個產品線真的很能打,從2.0的資產生成到現在World 2.0的整個場景生成,騰訊在3D這塊的投入比想象中大得多

  • 頭像
    41iuqu1
    上個月剛用混元3D 2.5的API做了個電商產品的360度展示,客戶挺滿意的。現在2.1版本都出了,版本迭代速度跟不上了😂

  • 頭像
    史濤
    2025年初混元3D 2.0剛出的時候就體驗過,當時文生3D速度62秒已經很快了。現在世界模型2.0直接生成整個場景,這升級幅度有點誇張

  • 頭像
    w9av73dj4
    免費額度100積分真的不夠用啊,生幾個模型就沒了。專業版20積分一次,算下來2塊錢出頭一個模型,批次用的話成本不低

  • 頭像
    yellowbear761
    LATTICE 10B引數的形狀模型確實厲害,之前2.0版本生手的時候手指經常不對,現在好多了。PBR材質那塊也終於能用了,金屬度和粗糙度的真實感比之前強了一個檔次