OpenAI将GPT-5.6 Luna降价80%,三周内打响AI价格战
史上最大降幅
OpenAI 在 7 月 31 日凌晨扔出一张新的定价表,让整个 AI API 市场吃了一惊——入门级模型 GPT-5.6 Luna 的价格直接砍掉了 80%。
具体数字是这样的:Luna 的输入价格从每百万 token 1 美元降到 0.2 美元,输出价格从 6 美元降到 1.2 美元。中端模型 Terra 也降了 20%,输入 2 美元、输出 12 美元。旗舰级 Sol 倒是没降价,但新增了一个 Fast 模式,响应速度提升 2.5 倍,定价翻倍——这次把「速度」单独拎出来当成了一个独立的付费维度。
距离 GPT-5.6 系列发布才过了三周。这个降价节奏在 AI 行业里相当少见。通常新模型家族发布后,厂商会维持价格稳定好几个月,但 OpenAI 不到一个月就开始调价,而且 Luna 的降价幅度堪称史上最大。
降价前一天,OpenAI 发布了一篇工程概述,详细说明了推理栈上的多项改进。工程师们重写了 GPU 内核,让服务成本降低了约 20%;重新设计了 Sol 的推测性解码系统,token 生成效率提升了超过 15%;还更新了智能体运行时,在多步骤工作流里更广泛地利用提示词缓存,减少重复计算。这些优化让 GPT-5.6 能够以「每美元提供显著更高的智能」。
但真正驱动降价的,恐怕不只是技术优化。竞争压力才是那把悬着的刀。中国开源模型正在快速逼近。Kimi K3 的 API 定价每百万 token 输出 100 元人民币(约 15 美元),虽然绝对值看起来不便宜,但结合它的性能表现,对很多开发者来说已经是个极具吸引力的选项。
Altman 在社交平台上的表态很直白:「在每个层级提供最佳的价格与智力性价比。」翻译一下:OpenAI 正在打一场全方位的价格战——入门层用 Luna 碾压,中端用 Terra 卡位,高端用 Sol 的品质和速度守住天花板。
值得注意的一个细节是,Luna 降价的幅度远大于 Terra。这意味着 OpenAI 的策略非常清晰:开发者不再需要为每一步推理都掏出高昂费用。很多智能体应用的中间步骤完全可以用 Luna 级别的模型完成,只有最后需要高阶推理时才调用 Sol。这种分层调用的模式一旦普及,整个 AI 应用的算力成本结构都会被重塑。
对于习惯了「AI 一年比一年贵」的开发者来说,这无疑是个好消息。但对于那些以低价路线为卖点的竞争对手来说,OpenAI 这一步棋的杀伤力相当直接。