白宫想封、微软想用:OpenAI 最大金主内测 Kimi K3,年省 6 亿美元
Copilot 部分推理请求或迁移至中国开源模型,单 Token 成本最多降 60%,闭源阵营蒸馏指控随之而来
一边是白宫琢磨着封禁,一边是自家最大金主偷偷测试——中国大模型 Kimi K3 这一周在美国的待遇,堪称魔幻。据观察者网 7 月 23 日报道,The Information 披露微软正在内部测试月之暗面的 Kimi K3,评估把 Copilot 的部分推理请求从 OpenAI 和 Anthropic 的模型迁移过去。微软内部测算,此举每年最多可节省约 6 亿美元云基础设施成本,折合人民币超 40 亿元,单 Token 推理成本最多下降 60%,相当于微软 2026 财年第三财季智能云部门净利润的 15%。

微软的算盘不难理解。Copilot 是其 AI 战略核心产品,自转向按 Token 消耗计费后,推理成本成了最直观的可变成本。而 Kimi K3 于 7 月 16 日上线,总参数 2.8 万亿,是全球参数规模最大的开源模型;独立评测机构 Artificial Analysis 的智能指数显示,K3 综合得分 57 分位列全球第三,仅次于 Claude Fable 5 和 GPT-5.6 Sol,前端编程榜单更是登顶全球第一。微软计划两个月内完成初步技术验证,并推进 K3 上架 Azure。值得注意的是,微软看中的是代码补全、基础问答这类非核心场景的成本效率,并非要在前沿能力上换血。
用脚投票的美国公司远不止微软。OpenRouter 数据显示,2026 年 2 月以来,中国模型在美国企业经该平台调用的 Token 中每周占比均超 30%,峰值一度达 46%,而 2025 年上半年这个数字只有 4.5%。原因很直白:中国开源模型的使用成本比 OpenAI、Anthropic 的旗舰便宜 60% 到 90%。Cursor 给 Composer 2 选了 Kimi K2.5;OpenAI 前 CTO 穆拉蒂的 Thinking Machines 首款模型沿用 DeepSeek-V3 架构;创业公司 Lindy 六月把全部流量从 Claude 切到 DeepSeek,CEO 形容「成本曲线直接崩落到地板上」;桥水基金则微调阿里 Qwen 拿到了超过部分顶级闭源模型的表现。
闭源阵营的反应相当激烈。OpenAI 战略未来主管鲍尔一边承认 K3 是「非常优秀的模型」,一边公开建议美国政府「不需要证据」,用「中国模型可能有后门」之类的软性法规制造监管恐慌——此言随即被硅谷投资人斥为「监管俘获」。Anthropic CEO 阿莫代伊在国会听证会上声称 K3 蒸馏了其模型,甚至包括一款「尚未公开的未来模型」。7 月 22 日,美国总统科技顾问克拉齐奥斯亲自下场,指控月之暗面对 Anthropic 前沿模型 Fable 实施「大规模、隐蔽的工业级蒸馏」。
月之暗面的回击也很硬。副总裁黄震昕表示 K3 的跨越式提升「核心依托底层原创架构创新,并非对任何现有模型进行蒸馏复刻」。团队成员 Randy Xia 更是直接用时间线反讽:Fable 7 月 1 日发布,K3 7 月 15 日上线——「我们仅用 15 天就训练出一个全新的前沿模型,这简直创造了吉尼斯世界纪录。」事实上,类似的蒸馏指控至今没有公开证据链,但每次都精准踩在中国模型性能跃升的节点上。
这一周的连环动态确认了一个行业拐点:大模型竞争从性能竞赛转入成本竞赛。K3 发布后 72 小时内,美股 AI 板块合计蒸发约 4700 亿美元,《财富》称之为「第二次 DeepSeek 冲击」。从 DeepSeek 到 Qwen、GLM 再到 Kimi,中国开源模型正集体占据全球推理成本曲线的低位区间,把性能差距压缩到「够用」的范围内。微软那笔 6 亿美元的测算,第一次把行业心照不宣的事实用美元明码标价写了出来——下半场,账本的权重正在超过榜单。