月之暗面发布Kimi K3:2.8万亿参数的最大开源模型
中国模型追平美国
7月16日深夜,月之暗面扔出一颗重磅炸弹。新一代旗舰模型Kimi K3正式亮相,总参数高达2.8万亿,是迄今全球规模最大的开源权重大模型。它配备100万token的超长上下文窗口,原生支持视觉理解,API已经上线,完整模型权重则会在7月27日前公开发布。这意味着开发者很快就能下载、微调、审计这套模型。
K3的技术底座有两处原创。其一是Kimi Delta Attention,一种混合线性注意力机制,用来解决「长上下文算力爆炸」的老大难问题;其二是Attention Residuals,官方称是对残差连接的直接替代,能带来稳定的扩展收益。正是这套架构,让一个2.8万亿参数的庞然大物,在推理成本上变得可以承受。从MoE结构看,它在896个专家里只激活16个,像医院分诊一样,把任务精准导向最相关的「专科医生」。
市场反应很直接。摩根士丹利把K3称为「中国前沿模型全面追赶美国」的标志性信号——在规模、性能、定价三个维度同步突破。在Artificial Analysis的全球智能指数里,K3排在第三,仅次于两家美国顶级闭源模型;在Arena.ai的编程榜上更拿下第一。马斯克也在评论区留了一句「Impressive」。
真正值得玩味的,是定价。K3的输出价定在每百万token 100元人民币,是中国主流大模型里最高的,远高于DeepSeek的6元和智谱的28元。大摩认为这反而是好事——说明中国模型不再靠「便宜」抢市场,而是有了往上定价的底气。与此同时,整个行业涨价已成主旋律,智谱分三轮提价,DeepSeek峰谷定价,供需两端都在挤压厂商往价值兑现走。
把视野拉远,K3的出现把开源阵营的技术门槛直接抬到了3万亿级别。对月之暗面自身,这是支撑其估值半年涨六倍、冲刺IPO的关键一役。而对普通开发者和企业来说,7月27日权重开源后,一套能跑长程编程、自带视觉的顶级模型将免费可得——这才是这场发布最实在的意义,也是中国开源力量第一次站上世界之巅。