月之暗面发布2.8万亿参数开源模型 Kimi K3

全球最大开源模型

2026-07-18 14:54

中国大模型又扔出一颗重磅弹。7月16日,在2026世界人工智能大会开幕前夕,月之暗面发布了新一代模型 Kimi K3,参数规模达到2.8万亿。官方称这是目前全球参数最大的开源模型,也是首个开源的3万亿级别模型,原生支持视觉理解,并拥有100万 token 的上下文窗口。

Kimi K3 不是靠简单堆参数取胜。它的架构做了两处关键更新:一是 KDA(Kimi Delta Attention,混合线性注意力机制),二是注意力残差(Attention Residuals),目的都是让信息在更长序列、更深模型里流动得更顺。在此之上,它大幅扩大了 MoE 的稀疏度——结合 Stable LatentMoE 框架,模型可以在896个专家中只高效激活16个。再加上训练方法和数据配方的优化,整体扩展效率比上一代 K2 提升了约2.5倍。

能力上,Kimi K3 表现出鲜明的「长程」特征。它很擅长长程编程:在极少人工监督下,能持续完成耗时很长的工程任务,理解大型代码库,并协调使用终端工具;在软件工程场景里,它能结合源代码、渲染结果、运行日志和测试反馈,判断下一步往哪改。在 Frontend Code Arena 评测里,K3 以1679分超过 Claude Fable 5 登顶;在芯片设计上,它甚至在48小时内独立设计并验证了一款芯片。

但必须说清边界。月之暗面自己承认,K3 的整体表现仍落后于最强的闭源模型 Claude Fable 5 和 GPT-5.6 Sol,不过它在整套评测里已经展现出前沿水平,并稳定超过其他所有模型。完整模型权重将在7月27日前开源,API 定价为输入每百万 token 2到20元、输出100元。

回过头看,过去12个月里有9个月,Kimi 系列都保持着开源模型的规模上限。这次 K3 把中国开源大模型的天花板又顶高了一截。对开发者和企业来说,一个能跑长程任务、上下文够长的开源旗舰,意味着很多过去要团队协作数周的工作,现在有可能交给一个模型连续跑完。