Anthropic 上新 Claude Opus 5:性能追平旗舰,价格砍半
AI 价格战进入新维度
美东时间 7 月 24 日,Anthropic 正式发布新一代 Claude Opus 模型——Opus 5。这已经不是一次单纯的旗舰升级了。它的核心卖点很直接:在多个任务上的性能已经逼近公司最先进的旗舰模型 Fable 5,但 API 价格只有后者的一半。 换句话说,Anthropic 在重新定义「什么才叫够用」。
先说价格。Opus 5 的 API 定价和上一代 Opus 4.8 一模一样:每百万 token 输入 5 美元、输出 25 美元。而 Fable 5 的定价是 10 美元和 50 美元——Opus 5 直接砍半。但真正让人意外的不是便宜,而是它便宜的同时,性能居然没怎么缩水。

在软件工程基准 Frontier-Bench 上,Opus 5 超过所有现有模型,成绩比 Opus 4.8 翻了一倍。在 CursorBench 3.2 的 Max 档下,Opus 5 得分 70.0%,距离 Fable 5 的 70.5% 只差 0.5 个百分点——但每任务成本只有 8.23 美元,不到 Fable 5 的一半。换句话说,如果你不是非要跑那 0.5% 的极端场景,Opus 5 反而是性价比更高的选择。
在更考验「动手能力」的测试里,差距就更微妙了。OSWorld 2.0 电脑操作测试中,Opus 5 以略高于 Fable 5 三分之一的成本,就超过了后者的最佳成绩。ARC-AGI 3 这个专门测「解新题」的基准上,它的得分是第二名的三倍。这意味着,Opus 5 的核心优势不是「算得快」,而是「想得明白」。
Anthropic 把这次发布的定位说得很清楚:Opus 5 不是用来取代旗舰 Fable 5 的,而是面向大规模部署的「工作马」。Claude Max 订阅的默认模型已经换成了它,Pro 用户能用到的最强模型也是它。在 API 上它还多了一个 Fast 模式,可以跑到 2.5 倍速——当然价格翻倍,但适合对延迟敏感的实时场景。
一个值得注意的细节是安全策略的调整。Anthropic 称 Opus 5 的安全分类器拦截触发率预计比 Fable 5 低约 85%。被拦下的请求不再直接拒绝,而是自动回退到 Opus 4.8 继续干活。如果你是每天写代码的开发者,这意味着被「误伤」的概率少了一大截。同时,Opus 5 刻意没在网络攻击能力上训练:它能发现漏洞,但在把漏洞变成可用的攻击代码上,被远远甩在后面——用官方的话说,它「看得见 bug,但不会写 exploit」。

这一代 Opus 发布还有一个更大的背景。就在一周前,月之暗面发布了 2.8 万亿参数的开源模型 Kimi K3,DeepSeek 也持续用低价和开放权重策略冲击市场。中国企业客户已经开始重新计算 AI 投入产出比。当更便宜的模型已经能完成企业 80% 以上的日常任务,客户还愿不愿意为剩余的性能差距付两倍甚至数倍的价格? 这个问题已经摆在了每一家 AI 公司面前。
Anthropic 这次给出的回答是,把接近旗舰的能力下沉到「日常能随便用」的价位。Opus 5 的发布说明,AI 模型的竞争指标正在发生根本性变化——从「谁最强」转向「谁能在合理价格上做到足够强」。 下一场仗,打的不是天花板,是性价比。