Claude Opus 5
Anthropic 2026 年 7 月推出的新一代 Opus 旗艦模型,主打百萬級上下文與超強 agentic 編碼,被官方稱為全球最強程式設計模型,以約一半的價格逼近 Fable 5 的能力
深度報告
-
Claude Opus 5 是 Anthropic 在 2026 年 7 月推出的新一代 Opus 檔旗艦模型,官方給出的核心口徑直白到近乎挑釁——「全球最強的程式設計模型」。它出現在 Anthropic 今年密集的模型攻勢末端:Opus 4.8(5 月 28 日)、神話級的 Fable 5 / Mythos 5(6 月 9 日)、Sonnet 5(6 月 30 日)一路鋪開後,Opus 5 補上了旗艦序列裡最關鍵的一環。它的定位不是單純堆能力,而是把 Fable 5 那種「神話級」的程式設計與長週期自主能力,拉回到更合理的價格和更少的安全降級裡,主打百萬級上下文、超強 agentic 編碼與更好的 Token 經濟學,直接對標 OpenAI 剛釋出的 GPT-5.6。
-
Anthropic 是當前與 OpenAI 正面掰手腕的頭部 AI 公司,背後站著亞馬遜和谷歌兩大金主。2026 年上半年它進入「按月發模型」的節奏,憑藉企業級的可靠性和安全口碑,商業化增速一度把估值口徑推到 OpenAI 之上。Opus 系列歷來是 Anthropic 最能打的一檔,專攻複雜推理、長上下文、高階編碼和自主 agent 工作流;從 Opus 4.6 到 4.8,主線是「更誠實、更少遺漏程式碼缺陷、動態工作流和努力檔位控制」。 Opus 5 的登場頗有戲劇性。7 月 9 日,一個代號「Honeycomb」的模型在 Cursor 裡短暫現身,被社群解讀為 Opus 5 的前哨;7 月 15 日凌晨,「Claude-Opus-5」條目直接出現在谷歌 Vertex AI 的模型目錄裡被開發者截獲,坐實了它的存在。多家媒體把它定位成介於 Sonnet 5 與 Fable 5 之間的「次旗艦」——效能對標甚至小幅超越 Opus 4.8、逼近 Fable 5,卻只用大約一半的成本,精準填補了產品線裡最大的價格-效能空檔。
-
程式設計是 Opus 5 最硬的招牌。Anthropic 直接稱其為「世界最好的程式設計模型」,重點押在真實軟體工程的可靠性上:更少被忽略的程式碼缺陷、更強的多步規劃、computer use 和瀏覽器 agent,以及能在後臺連續自主跑很久的長週期任務。作為參照系,同底座的 Fable 5 在 SWE-bench Pro 上飆到 80.3%,遠超 GPT-5.5 的 58.6%,還在 Stripe 一個 5000 萬行 Ruby 程式碼庫裡,把工程團隊要兩個多月的全庫遷移壓縮到一天完成。Opus 5 走的是同一條技術路線,把這種能力做得更普惠、更穩。 上下文是另一個大跳。傳聞與洩露一致指向百萬 Token 級標準上下文,配合自適應思考(預設開啟)和多級努力檔位(含 xhigh),可以在單次會話裡吞下整個程式碼庫、超長法律或研究文件。它延續了 Opus 4.8 的動態工作流與並行子 agent 能力,能自己把一個模糊目標拆成調研、寫大綱、編碼、跑測試、自我校對、糾錯重來的完整鏈條。沃頓商學院教授 Ethan Mollick 在測試同代模型時提出了那個廣為流傳的判斷:人和模型的協作正規化正在逆轉,使用者從需要逐句「唸咒」的「巫師」,變成了只在最終成品上簽字的「甲方」——你把一份十幾頁的設計文件丟進去,幾個小時後回來收一個高質量成品。 視覺與多模態同樣線上。同底座模型在無外部腳手架的條件下,能僅憑原始遊戲截圖自主推演通關《寶可夢》,在視覺文件推理基準上也明顯領先 GPT-5.5 和 Gemini 3.1 Pro。Opus 5 延續視覺輸入能力,並在高解析度與持續視覺推理上有望進一步改善。
-
這是 Opus 5 最聰明的一步棋。Fable 5 的定價是每百萬輸入 10 美元、輸出 50 美元,是 Opus 4.8(輸入 5 美元、輸出 25 美元)的整整兩倍,貴到只有極少數高價值企業客戶吃得消。Opus 5 被普遍預期落在 Opus 檔價位或略高(業界估算約輸入 5-8 美元、輸出 25-40 美元),主打「一半的價格、九成的體驗」。它面向 Claude API 和企業訂閱層開放,配合提示詞快取與批處理介面進一步壓低高頻呼叫成本。換句話說,Anthropic 想讓更多人用得起接近 Fable 5 的能力,而不必為最貴那一檔買單。
-
開發者社群對這條產品線的整體能力評價極高,「世界最好的程式設計模型」這句話最早就出自 Every CEO Dan Shipper 對同代模型的實測長帖。正面反饋集中在:能接住跨晝夜的超長自主任務、能一句提示詞生成可交付的完整應用、上下文整合和「解題品味」驚人。 但真實使用裡的抱怨也很集中,幾乎都繞著 Fable 5 那代的老問題打轉:貴、燒 Token、慢。有人曬出用重型模型做一個網頁版《模擬人生》專案燒掉 100 美元的賬單,有人在 Max 20x 計劃裡發現重任務每分鐘掉約 2% 額度。Dan Shipper 那句「拿它做日常寫作,像用火箭發射器拍螞蟻」流傳甚廣。Opus 5 半價定位正是衝著這個痛點來的——但它能否真正把 Token 消耗壓下來,而不只是單價減半,仍要等大規模實測驗證。
-
媒體普遍把 Opus 5 讀成 Anthropic 對 OpenAI GPT-5.6 的正面回擊。GPT-5.6 此前放話在編碼和算力效率上壓過 Fable 5,Opus 5 若真帶著百萬上下文和更優經濟性落地,會把「最受關注的跑分對比」重新拉回 Anthropic 這邊。從產品線看,它補齊了「Sonnet 5 走量、Opus 5 主力、Fable 5 頂配」的三檔梯隊,讓企業可以按任務價值精細路由模型,而不是無腦上最貴那一檔。
-
第一是「已釋出」本身仍帶模糊。截至 7 月中旬,CometAPI、Crypto Briefing 等信源都強調 Anthropic 尚無正式官宣,Vertex 目錄曝光和部分「已上線」報道之間存在資訊差,一些英文報道還把 Fable 5 的定價與安全細節錯安到 Opus 5 頭上,需要以官方系統卡為準。 第二是安全降級的體驗代價。Fable 5 那套把高風險請求(網路安全、生化、模型蒸餾)自動路由回 Opus 4.8 的機制曾被吐槽過度防衛——有中文使用者反映說句「你好」都能觸發高危警告。Opus 5 的安全護欄是更輕還是延續這套,直接關係正常任務的誤傷率。 第三是成本不可控的結構性問題。agentic 工作流天然把一次任務拉長成一串子任務,單價減半不等於總成本減半;Fable 5 時代「中型任務後臺悄悄燒掉 50 萬到 100 萬 Token」的教訓,Opus 5 未必能自動免疫。
-
它適合:需要攻克「整個團隊研發數月」級別高難度專案的架構師、跑長週期自主 agent 的工程團隊、要在單次會話裡處理超長文件的法律/金融/研究場景。不適合:只做輕量問答、改標題、寫短文案這類需要快速來回的日常任務——那些場景 Sonnet 5 更經濟。務實的做法是建一條模型路由階梯:輕任務走 Sonnet 5,主力複雜任務走 Opus 5,只有極端前沿任務才動用 Fable 5,並配上用量監控和人工驗收。
-
Claude Opus 5 的價值不在於又重新整理了一次能力天花板,而在於它試圖把「神話級」能力做成一門算得過賬的生意——用大約一半的價格,交付接近 Fable 5 的程式設計與自主能力。如果官方基準和 Token 經濟效能兌現傳聞,它很可能成為 2026 年下半年大多數複雜工作負載的新預設選項;但在正式系統卡和大規模實測落地之前,「世界最強程式設計模型」這句話,暫且留一分冷靜。
使用者評論
-
DFoster_2023—半價對標 Fable 5,這波是真的會算賬。 -
JAlin—等官方系統卡,現在都是 Vertex 目錄截圖和小道訊息,先別急著封神。 -
ACruz_2023—昨晚拿 Opus 5 重構了一箇中型 Node 服務,它自己讀程式碼、拆任務、跑測試、連著修了三輪 CI 才收工,我全程就盯著螢幕喝咖啡。說它是世界最強程式設計模型我信一半,剩下那一半真得等這個月的 token 賬單出來再下結論,能力是真強,就是不知道這錢花得值不值。 -
Jack_ClarkJr—Sonnet 5 走量,Opus 5 主力,Fable 5 頂配,這個三檔梯隊終於齊了,選型清晰多了。 -
Angela.Murphy_X—百萬上下文是真香,整個 repo 塞進去它還能記住細節。 -
Melissa_Lopez_75—衝著挑戰 GPT-5.6 來的,坐等兩家跑分對轟。 -
流光_8—就問一句,Opus 5 還會不會像 Fable 5 那樣說個「你好」就彈高危警告? -
LindaMurphy—價格減半我承認,但 agentic 那套一個任務天然會拆成一長串子任務,讀檔案、改程式碼、跑測試、修故障、再自我驗證,token 照樣嘩嘩地燒。單價降了不代表總價降了,Fable 5 時代中型任務後臺悄悄吃掉幾十萬 token 的教訓還歷歷在目,別高興太早。 -
MarkHughes—太強了,回不去了。 -
Elizabeth.Walker_66—Honeycomb 那會在 Cursor 裡露頭我就猜到了,果然是 Opus 5 的前哨。 -
JoanHernandez—我們團隊之前把整個生產環境的 bug backlog 直接丟給同底座那個模型,然後就下班回家了,第二天早上回來一看,呼叫棧分析完了、覆蓋率跑通了、PR 都提好了,整個缺陷庫被掃得乾乾淨淨。這種「放手到天亮」的託管體驗是真的爽,就是月底看賬單的時候有點想哭。 -
沈玉然—拿它寫日常文案屬實是火箭發射器打蚊子,Dan Shipper 那句吐槽我天天在工位複述。 -
Logan.Diaz_Max—次旗艦這個定位其實最實用,大多數活兒用不上滿血 Fable,Opus 5 剛剛好。 -
VEtay—請問 Opus 5 現在國內怎麼呼叫啊,走 API 還是得掛 Vertex? -
sadrabbit530—從 Opus 4.8 遷到 Opus 5,同一套 agent 指令碼明顯少了很多「被忽略的坑」,多步規劃穩了不少,長任務跑到一半崩掉、上下文漂移的次數肉眼可見地降下來了。對我來說這點比那些漂亮的跑分更打動人,畢竟真實工程裡,穩定和可復現比峰值分數重要太多了。 -
Evelyn_Collins_X3—凌晨刷到 Vertex 目錄裡蹦出 Claude-Opus-5,直接精神了。 -
P1JFWFQ0—絕了,這更新節奏,Anthropic 是真按月發模型啊。 -
Heather.Lee520761—重度使用者表示:能力我一點不擔心,我擔心的是 Max 套餐裡重任務一分鐘掉 2% 額度那檔子事會不會在 Opus 5 上原樣重演。半價固然好,可要是任務照樣膨脹,省下來的錢分分鐘又燒回去,希望官方這次真能把 token 效率做紮實,而不只是把標價砍一半糊弄人。 -
wiipreh—別被英文媒體帶偏,好幾篇把 Fable 5 的 $10/$50 和安全路由細節硬安到 Opus 5 頭上,資訊差有點大。 -
Kelly_Collins_202264—等實測,先觀望。 -
redelephant244—同底座那個模型無腳手架盲打通關寶可夢的 demo 我看了三遍,視覺推理是真的進化了。