Kimi K3明日開源:2.8萬億引數全球最大開源模型,Frontend Code Arena登頂
7月27日鎖定權重發布
7月27日,月之暗面將正式向全球開發者開放Kimi K3的完整模型權重。這無疑是今年國產AI圈最受期待的一個時間節點。
Kimi K3的體量是2.8萬億引數,採用混合專家架構(MoE),896個專家中每個Token啟用16個,實際啟用引數約500億。上下文視窗拉到100萬Token,原生支援視覺理解。在Frontend Code Arena上,它以1679分位居榜首——這是目前全球開源模型的最高紀錄。
一個關鍵資訊:Kimi K3採用Modified MIT許可。這意味著任何個人或公司都可以下載、修改、商用,不需要審批、不需要授權費。在「開源 vs 閉源」爭論正熱的當下,月之暗面這一手選擇很明確——走開放路線。
技術上,K3最值得關注的兩個創新是KDA混合線性注意力機制和Attention Residuals。前者讓100萬Token的長上下文解碼速度比標準注意力機制快了6.3倍——這個數字很實在:如果用標準Transformer跑100萬Token上下文,推理成本會高到不可接受;KDA把這條路走通了。後者則是用殘差連線替代傳統的跳躍連線方案,讓資訊在深層網路裡傳得更順。
一個有意思的資料:K3在連續48小時的自主Agent執行中,獨立用開源EDA工具完成了一顆4平方毫米晶片的完整設計流程,實現了100MHz的時序收斂。 這雖然不是商業級晶片設計的全部,但展示了模型在長週期自主任務上的能力邊界。
從行業視角看,Kimi K3的釋出有一個更大的背景:中國開源AI模型正在集體逼近美國閉源旗艦的防線。智譜GLM-5.2已經被Databricks設為預設程式設計引擎,DeepSeek V4即將登陸騰訊雲,而K3在多項基準上與Claude Fable 5和GPT-5.6 Sol的差距已經縮小到個位數百分點。
價格方面,K3的API定價是輸入每百萬Token 3美元、輸出每百萬Token 15美元,快取輸入僅需0.30美元。對比Claude Opus 5的5/25美元和GPT-5.6的定價,成本優勢相當明顯。
月之暗面同步公佈的還有技術報告和完整的基準測試資料。關於這塊巨無霸模型的所有細節,將在開源當天全部公開。