白宮想封、微軟想用:OpenAI 最大金主內測 Kimi K3,年省 6 億美元

Copilot 部分推理請求或遷移至中國開源模型,單 Token 成本最多降 60%,閉源陣營蒸餾指控隨之而來

2026-07-24 10:35

一邊是白宮琢磨著封禁,一邊是自家最大金主偷偷測試——中國大模型 Kimi K3 這一週在美國的待遇,堪稱魔幻。據觀察者網 7 月 23 日報道,The Information 披露微軟正在內部測試月之暗面的 Kimi K3,評估把 Copilot 的部分推理請求從 OpenAI 和 Anthropic 的模型遷移過去。微軟內部測算,此舉每年最多可節省約 6 億美元雲基礎設施成本,摺合人民幣超 40 億元,單 Token 推理成本最多下降 60%,相當於微軟 2026 財年第三財季智慧雲部門淨利潤的 15%。

微軟內測 Kimi K3
微軟內測 Kimi K3

微軟的算盤不難理解。Copilot 是其 AI 戰略核心產品,自轉向按 Token 消耗計費後,推理成本成了最直觀的可變成本。而 Kimi K3 於 7 月 16 日上線,總引數 2.8 萬億,是全球引數規模最大的開源模型;獨立評測機構 Artificial Analysis 的智慧指數顯示,K3 綜合得分 57 分位列全球第三,僅次於 Claude Fable 5 和 GPT-5.6 Sol,前端程式設計榜單更是登頂全球第一。微軟計劃兩個月內完成初步技術驗證,並推進 K3 上架 Azure。值得注意的是,微軟看中的是程式碼補全、基礎問答這類非核心場景的成本效率,並非要在前沿能力上換血。

用腳投票的美國公司遠不止微軟。OpenRouter 資料顯示,2026 年 2 月以來,中國模型在美國企業經該平臺呼叫的 Token 中每週佔比均超 30%,峰值一度達 46%,而 2025 年上半年這個數字只有 4.5%。原因很直白:中國開源模型的使用成本比 OpenAI、Anthropic 的旗艦便宜 60% 到 90%。Cursor 給 Composer 2 選了 Kimi K2.5;OpenAI 前 CTO 穆拉蒂的 Thinking Machines 首款模型沿用 DeepSeek-V3 架構;創業公司 Lindy 六月把全部流量從 Claude 切到 DeepSeek,CEO 形容「成本曲線直接崩落到地板上」;橋水基金則微調阿里 Qwen 拿到了超過部分頂級閉源模型的表現。

閉源陣營的反應相當激烈。OpenAI 戰略未來主管鮑爾一邊承認 K3 是「非常優秀的模型」,一邊公開建議美國政府「不需要證據」,用「中國模型可能有後門」之類的軟性法規制造監管恐慌——此言隨即被矽谷投資人斥為「監管俘獲」。Anthropic CEO 阿莫代伊在國會聽證會上聲稱 K3 蒸餾了其模型,甚至包括一款「尚未公開的未來模型」。7 月 22 日,美國總統科技顧問克拉齊奧斯親自下場,指控月之暗面對 Anthropic 前沿模型 Fable 實施「大規模、隱蔽的工業級蒸餾」。

月之暗面的回擊也很硬。副總裁黃震昕表示 K3 的跨越式提升「核心依託底層原創架構創新,並非對任何現有模型進行蒸餾復刻」。團隊成員 Randy Xia 更是直接用時間線反諷:Fable 7 月 1 日釋出,K3 7 月 15 日上線——「我們僅用 15 天就訓練出一個全新的前沿模型,這簡直創造了吉尼斯世界紀錄。」事實上,類似的蒸餾指控至今沒有公開證據鏈,但每次都精準踩在中國模型效能躍升的節點上。

這一週的連環動態確認了一個行業拐點:大模型競爭從效能競賽轉入成本競賽。K3 釋出後 72 小時內,美股 AI 板塊合計蒸發約 4700 億美元,《財富》稱之為「第二次 DeepSeek 衝擊」。從 DeepSeek 到 Qwen、GLM 再到 Kimi,中國開源模型正集體佔據全球推理成本曲線的低位區間,把效能差距壓縮到「夠用」的範圍內。微軟那筆 6 億美元的測算,第一次把行業心照不宣的事實用美元明碼標價寫了出來——下半場,賬本的權重正在超過榜單。