Anthropic 上新 Claude Opus 5:效能追平旗艦,價格砍半
AI 價格戰進入新維度
美東時間 7 月 24 日,Anthropic 正式釋出新一代 Claude Opus 模型——Opus 5。這已經不是一次單純的旗艦升級了。它的核心賣點很直接:在多個任務上的效能已經逼近公司最先進的旗艦模型 Fable 5,但 API 價格只有後者的一半。 換句話說,Anthropic 在重新定義「什麼才叫夠用」。
先說價格。Opus 5 的 API 定價和上一代 Opus 4.8 一模一樣:每百萬 token 輸入 5 美元、輸出 25 美元。而 Fable 5 的定價是 10 美元和 50 美元——Opus 5 直接砍半。但真正讓人意外的不是便宜,而是它便宜的同時,效能居然沒怎麼縮水。

在軟體工程基準 Frontier-Bench 上,Opus 5 超過所有現有模型,成績比 Opus 4.8 翻了一倍。在 CursorBench 3.2 的 Max 檔下,Opus 5 得分 70.0%,距離 Fable 5 的 70.5% 只差 0.5 個百分點——但每任務成本只有 8.23 美元,不到 Fable 5 的一半。換句話說,如果你不是非要跑那 0.5% 的極端場景,Opus 5 反而是價效比更高的選擇。
在更考驗「動手能力」的測試裡,差距就更微妙了。OSWorld 2.0 電腦操作測試中,Opus 5 以略高於 Fable 5 三分之一的成本,就超過了後者的最佳成績。ARC-AGI 3 這個專門測「解新題」的基準上,它的得分是第二名的三倍。這意味著,Opus 5 的核心優勢不是「算得快」,而是「想得明白」。
Anthropic 把這次釋出的定位說得很清楚:Opus 5 不是用來取代旗艦 Fable 5 的,而是面向大規模部署的「工作馬」。Claude Max 訂閱的預設模型已經換成了它,Pro 使用者能用到的最強模型也是它。在 API 上它還多了一個 Fast 模式,可以跑到 2.5 倍速——當然價格翻倍,但適合對延遲敏感的實時場景。
一個值得注意的細節是安全策略的調整。Anthropic 稱 Opus 5 的安全分類器攔截觸發率預計比 Fable 5 低約 85%。被攔下的請求不再直接拒絕,而是自動回退到 Opus 4.8 繼續幹活。如果你是每天寫程式碼的開發者,這意味著被「誤傷」的機率少了一大截。同時,Opus 5 刻意沒在網路攻擊能力上訓練:它能發現漏洞,但在把漏洞變成可用的攻擊程式碼上,被遠遠甩在後面——用官方的話說,它「看得見 bug,但不會寫 exploit」。

這一代 Opus 釋出還有一個更大的背景。就在一週前,月之暗面釋出了 2.8 萬億引數的開源模型 Kimi K3,DeepSeek 也持續用低價和開放權重策略衝擊市場。中國企業客戶已經開始重新計算 AI 投入產出比。當更便宜的模型已經能完成企業 80% 以上的日常任務,客戶還願不願意為剩餘的效能差距付兩倍甚至數倍的價格? 這個問題已經擺在了每一家 AI 公司面前。
Anthropic 這次給出的回答是,把接近旗艦的能力下沉到「日常能隨便用」的價位。Opus 5 的釋出說明,AI 模型的競爭指標正在發生根本性變化——從「誰最強」轉向「誰能在合理價格上做到足夠強」。 下一場仗,打的不是天花板,是價效比。