月之暗面釋出2.8萬億引數開源模型 Kimi K3
全球最大開源模型
中國大模型又扔出一顆重磅彈。7月16日,在2026世界人工智慧大會開幕前夕,月之暗面釋出了新一代模型 Kimi K3,引數規模達到2.8萬億。官方稱這是目前全球引數最大的開源模型,也是首個開源的3萬億級別模型,原生支援視覺理解,並擁有100萬 token 的上下文視窗。
Kimi K3 不是靠簡單堆引數取勝。它的架構做了兩處關鍵更新:一是 KDA(Kimi Delta Attention,混合線性注意力機制),二是注意力殘差(Attention Residuals),目的都是讓資訊在更長序列、更深模型裡流動得更順。在此之上,它大幅擴大了 MoE 的稀疏度——結合 Stable LatentMoE 框架,模型可以在896個專家中只高效啟用16個。再加上訓練方法和資料配方的最佳化,整體擴充套件效率比上一代 K2 提升了約2.5倍。
能力上,Kimi K3 表現出鮮明的「長程」特徵。它很擅長長程程式設計:在極少人工監督下,能持續完成耗時很長的工程任務,理解大型程式碼庫,並協調使用終端工具;在軟體工程場景裡,它能結合原始碼、渲染結果、執行日誌和測試反饋,判斷下一步往哪改。在 Frontend Code Arena 評測裡,K3 以1679分超過 Claude Fable 5 登頂;在晶片設計上,它甚至在48小時內獨立設計並驗證了一款晶片。
但必須說清邊界。月之暗面自己承認,K3 的整體表現仍落後於最強的閉源模型 Claude Fable 5 和 GPT-5.6 Sol,不過它在整套評測裡已經展現出前沿水平,並穩定超過其他所有模型。完整模型權重將在7月27日前開源,API 定價為輸入每百萬 token 2到20元、輸出100元。
回過頭看,過去12個月裡有9個月,Kimi 系列都保持著開源模型的規模上限。這次 K3 把中國開源大模型的天花板又頂高了一截。對開發者和企業來說,一個能跑長程任務、上下文夠長的開源旗艦,意味著很多過去要團隊協作數週的工作,現在有可能交給一個模型連續跑完。