Anthropic 推出 Claude Opus 5,高端模型的「价格战」终于打响了
性能逼近旗舰,价格砍半
2026年7月25日凌晨,Anthropic 扔出了一枚不大不小的炸弹——新一代旗舰模型 Claude Opus 5 正式发布。跟以往那种先预告再限量推送的节奏不同,这次 Opus 5 几乎是在官宣的同时就上线了,AWS Bedrock 和 GitHub Copilot 当天就能用上,效率高得不像 Anthropic 的风格。
真正让人多看一眼的,不是性能提升本身,而是它的定价策略。
Opus 5 的 API 价格跟上一代 Opus 4.8 完全一样:输入每百万 token 5 美元,输出每百万 token 25 美元。但 Anthropic 自己说了,它的性能已经逼近公司最顶尖的模型 Fable 5——要知道 Fable 5 的价格可是 Opus 5 的两倍。换句话说,你花一半的钱,就能拿到几乎一样的能力。在 CursorBench 3.2 编程测试中,Opus 5 开启最高思考档位后的成绩跟 Fable 5 只差了 0.5%,成本却只要一半。这种「降维打击」式的定价,说白了就是要把高端模型的价钱打下来。
那它的实际表现到底怎么样?从各个评测来看,Opus 5 在编程和知识工作类任务上确实够强。Frontier-Bench 和 GDPval-AA 两个综合评测里都拿了第一,ARC-AGI 3(一个考验推理能力的硬核测试)和 Zapier AutomationBench(衡量 AI 智能体自动化能力)上的表现也大幅领先。科研方面,有机化学和结构生物学领域的推理能力有明显提升。当然它也并非全能——在网络安全这类专业任务上,仍然落后于 Anthropic 专门给安全客户准备的 Mythos 5。
这次 Opus 5 还引入了「可调节思考档位」的机制,用户可以根据任务复杂度来选择不同的处理深度。简单问题用浅层思考模式,响应更快还省钱;遇到复杂编程或者多步推理,可以拉满思考档位换取更高质量的输出。同时 Opus 5 还加入了 Fast 模式,响应速度能提升 2.5 倍,当然计费也翻倍——丰俭由人,总比一刀切强。
安全层面,Anthropic 这次强调了 Opus 5 是他们安全对齐程度最高的模型。自动化行为审计显示,它出现鲁莽或欺骗性行为的概率最低,遵循 Claude 宪章的表现也最好。还有一个值得注意的细节:如果 API 请求触发了安全分类器,系统会自动回退到 Opus 4.8 继续运行,而不是直接报错或者卡住——这种「安全兜底」设计,对大企业客户来说挺重要的。
Opus 5 同时是 Claude Max 的默认模型,也是 Pro 用户能用到的最强选项。你不需要额外付费就能切换到它,已经在订阅的用户相当于免费升了一级。
回头看看这一轮 AI 模型的价格趋势,事情就很有意思了。前面是 Kimi K3 把大模型的推理成本打到了令人咋舌的低价,现在 Anthropic 又以半价推出了接近旗舰水平的 Opus 5。AI 赛道的竞争正在从「谁更强」转向「谁更划算」——模型的绝对能力差距在缩小,价格和性价比反而成了关键的胜负手。
对开发者和企业来说,这是个实在的好消息。能用更低的成本在日常项目里跑一个高端模型,意味着很多之前因为 API 太贵而被搁置的想法,现在可以重新捡起来了。真正受冲击的,或许是那些定价还在高位的闭源模型——当 Opus 5 用一半的价钱干出了差不多的活,用户的迁移成本其实没那么高。
把视线拉远一点,这轮「模型降价潮」带来的影响可能比想象中更深。更便宜的推理成本会催生更多 AI 原生应用,反过来又拉动算力需求——所以英伟达大概也不会太担心。说到底,降价的受益者,是整个生态里的每一个人。