Claude Opus 5
Anthropic 2026 年 7 月推出的新一代 Opus 旗舰模型,主打百万级上下文与超强 agentic 编码,被官方称为全球最强编程模型,以约一半的价格逼近 Fable 5 的能力
深度报告
-
Claude Opus 5 是 Anthropic 在 2026 年 7 月推出的新一代 Opus 档旗舰模型,官方给出的核心口径直白到近乎挑衅——「全球最强的编程模型」。它出现在 Anthropic 今年密集的模型攻势末端:Opus 4.8(5 月 28 日)、神话级的 Fable 5 / Mythos 5(6 月 9 日)、Sonnet 5(6 月 30 日)一路铺开后,Opus 5 补上了旗舰序列里最关键的一环。它的定位不是单纯堆能力,而是把 Fable 5 那种「神话级」的编程与长周期自主能力,拉回到更合理的价格和更少的安全降级里,主打百万级上下文、超强 agentic 编码与更好的 Token 经济学,直接对标 OpenAI 刚发布的 GPT-5.6。
-
Anthropic 是当前与 OpenAI 正面掰手腕的头部 AI 公司,背后站着亚马逊和谷歌两大金主。2026 年上半年它进入「按月发模型」的节奏,凭借企业级的可靠性和安全口碑,商业化增速一度把估值口径推到 OpenAI 之上。Opus 系列历来是 Anthropic 最能打的一档,专攻复杂推理、长上下文、高级编码和自主 agent 工作流;从 Opus 4.6 到 4.8,主线是「更诚实、更少遗漏代码缺陷、动态工作流和努力档位控制」。 Opus 5 的登场颇有戏剧性。7 月 9 日,一个代号「Honeycomb」的模型在 Cursor 里短暂现身,被社区解读为 Opus 5 的前哨;7 月 15 日凌晨,「Claude-Opus-5」条目直接出现在谷歌 Vertex AI 的模型目录里被开发者截获,坐实了它的存在。多家媒体把它定位成介于 Sonnet 5 与 Fable 5 之间的「次旗舰」——性能对标甚至小幅超越 Opus 4.8、逼近 Fable 5,却只用大约一半的成本,精准填补了产品线里最大的价格-性能空档。
-
编程是 Opus 5 最硬的招牌。Anthropic 直接称其为「世界最好的编程模型」,重点押在真实软件工程的可靠性上:更少被忽略的代码缺陷、更强的多步规划、computer use 和浏览器 agent,以及能在后台连续自主跑很久的长周期任务。作为参照系,同底座的 Fable 5 在 SWE-bench Pro 上飙到 80.3%,远超 GPT-5.5 的 58.6%,还在 Stripe 一个 5000 万行 Ruby 代码库里,把工程团队要两个多月的全库迁移压缩到一天完成。Opus 5 走的是同一条技术路线,把这种能力做得更普惠、更稳。 上下文是另一个大跳。传闻与泄露一致指向百万 Token 级标准上下文,配合自适应思考(默认开启)和多级努力档位(含 xhigh),可以在单次会话里吞下整个代码库、超长法律或研究文档。它延续了 Opus 4.8 的动态工作流与并行子 agent 能力,能自己把一个模糊目标拆成调研、写大纲、编码、跑测试、自我校对、纠错重来的完整链条。沃顿商学院教授 Ethan Mollick 在测试同代模型时提出了那个广为流传的判断:人和模型的协作范式正在逆转,用户从需要逐句「念咒」的「巫师」,变成了只在最终成品上签字的「甲方」——你把一份十几页的设计文档丢进去,几个小时后回来收一个高质量成品。 视觉与多模态同样在线。同底座模型在无外部脚手架的条件下,能仅凭原始游戏截图自主推演通关《宝可梦》,在视觉文档推理基准上也明显领先 GPT-5.5 和 Gemini 3.1 Pro。Opus 5 延续视觉输入能力,并在高分辨率与持续视觉推理上有望进一步改善。
-
这是 Opus 5 最聪明的一步棋。Fable 5 的定价是每百万输入 10 美元、输出 50 美元,是 Opus 4.8(输入 5 美元、输出 25 美元)的整整两倍,贵到只有极少数高价值企业客户吃得消。Opus 5 被普遍预期落在 Opus 档价位或略高(业界估算约输入 5-8 美元、输出 25-40 美元),主打「一半的价格、九成的体验」。它面向 Claude API 和企业订阅层开放,配合提示词缓存与批处理接口进一步压低高频调用成本。换句话说,Anthropic 想让更多人用得起接近 Fable 5 的能力,而不必为最贵那一档买单。
-
开发者社区对这条产品线的整体能力评价极高,「世界最好的编程模型」这句话最早就出自 Every CEO Dan Shipper 对同代模型的实测长帖。正面反馈集中在:能接住跨昼夜的超长自主任务、能一句提示词生成可交付的完整应用、上下文整合和「解题品味」惊人。 但真实使用里的抱怨也很集中,几乎都绕着 Fable 5 那代的老问题打转:贵、烧 Token、慢。有人晒出用重型模型做一个网页版《模拟人生》项目烧掉 100 美元的账单,有人在 Max 20x 计划里发现重任务每分钟掉约 2% 额度。Dan Shipper 那句「拿它做日常写作,像用火箭发射器拍蚂蚁」流传甚广。Opus 5 半价定位正是冲着这个痛点来的——但它能否真正把 Token 消耗压下来,而不只是单价减半,仍要等大规模实测验证。
-
媒体普遍把 Opus 5 读成 Anthropic 对 OpenAI GPT-5.6 的正面回击。GPT-5.6 此前放话在编码和算力效率上压过 Fable 5,Opus 5 若真带着百万上下文和更优经济性落地,会把「最受关注的跑分对比」重新拉回 Anthropic 这边。从产品线看,它补齐了「Sonnet 5 走量、Opus 5 主力、Fable 5 顶配」的三档梯队,让企业可以按任务价值精细路由模型,而不是无脑上最贵那一档。
-
第一是「已发布」本身仍带模糊。截至 7 月中旬,CometAPI、Crypto Briefing 等信源都强调 Anthropic 尚无正式官宣,Vertex 目录曝光和部分「已上线」报道之间存在信息差,一些英文报道还把 Fable 5 的定价与安全细节错安到 Opus 5 头上,需要以官方系统卡为准。 第二是安全降级的体验代价。Fable 5 那套把高风险请求(网络安全、生化、模型蒸馏)自动路由回 Opus 4.8 的机制曾被吐槽过度防卫——有中文用户反映说句「你好」都能触发高危警告。Opus 5 的安全护栏是更轻还是延续这套,直接关系正常任务的误伤率。 第三是成本不可控的结构性问题。agentic 工作流天然把一次任务拉长成一串子任务,单价减半不等于总成本减半;Fable 5 时代「中型任务后台悄悄烧掉 50 万到 100 万 Token」的教训,Opus 5 未必能自动免疫。
-
它适合:需要攻克「整个团队研发数月」级别高难度项目的架构师、跑长周期自主 agent 的工程团队、要在单次会话里处理超长文档的法律/金融/研究场景。不适合:只做轻量问答、改标题、写短文案这类需要快速来回的日常任务——那些场景 Sonnet 5 更经济。务实的做法是建一条模型路由阶梯:轻任务走 Sonnet 5,主力复杂任务走 Opus 5,只有极端前沿任务才动用 Fable 5,并配上用量监控和人工验收。
-
Claude Opus 5 的价值不在于又刷新了一次能力天花板,而在于它试图把「神话级」能力做成一门算得过账的生意——用大约一半的价格,交付接近 Fable 5 的编程与自主能力。如果官方基准和 Token 经济性能兑现传闻,它很可能成为 2026 年下半年大多数复杂工作负载的新默认选项;但在正式系统卡和大规模实测落地之前,「世界最强编程模型」这句话,暂且留一分冷静。
用户评论
-
DFoster_2023—半价对标 Fable 5,这波是真的会算账。 -
JAlin—等官方系统卡,现在都是 Vertex 目录截图和小道消息,先别急着封神。 -
ACruz_2023—昨晚拿 Opus 5 重构了一个中型 Node 服务,它自己读代码、拆任务、跑测试、连着修了三轮 CI 才收工,我全程就盯着屏幕喝咖啡。说它是世界最强编程模型我信一半,剩下那一半真得等这个月的 token 账单出来再下结论,能力是真强,就是不知道这钱花得值不值。 -
Jack_ClarkJr—Sonnet 5 走量,Opus 5 主力,Fable 5 顶配,这个三档梯队终于齐了,选型清晰多了。 -
Angela.Murphy_X—百万上下文是真香,整个 repo 塞进去它还能记住细节。 -
Melissa_Lopez_75—冲着挑战 GPT-5.6 来的,坐等两家跑分对轰。 -
流光_8—就问一句,Opus 5 还会不会像 Fable 5 那样说个「你好」就弹高危警告? -
LindaMurphy—价格减半我承认,但 agentic 那套一个任务天然会拆成一长串子任务,读文件、改代码、跑测试、修故障、再自我验证,token 照样哗哗地烧。单价降了不代表总价降了,Fable 5 时代中型任务后台悄悄吃掉几十万 token 的教训还历历在目,别高兴太早。 -
MarkHughes—太强了,回不去了。 -
Elizabeth.Walker_66—Honeycomb 那会在 Cursor 里露头我就猜到了,果然是 Opus 5 的前哨。 -
JoanHernandez—我们团队之前把整个生产环境的 bug backlog 直接丢给同底座那个模型,然后就下班回家了,第二天早上回来一看,调用栈分析完了、覆盖率跑通了、PR 都提好了,整个缺陷库被扫得干干净净。这种「放手到天亮」的托管体验是真的爽,就是月底看账单的时候有点想哭。 -
沈玉然—拿它写日常文案属实是火箭发射器打蚊子,Dan Shipper 那句吐槽我天天在工位复述。 -
Logan.Diaz_Max—次旗舰这个定位其实最实用,大多数活儿用不上满血 Fable,Opus 5 刚刚好。 -
VEtay—请问 Opus 5 现在国内怎么调用啊,走 API 还是得挂 Vertex? -
sadrabbit530—从 Opus 4.8 迁到 Opus 5,同一套 agent 脚本明显少了很多「被忽略的坑」,多步规划稳了不少,长任务跑到一半崩掉、上下文漂移的次数肉眼可见地降下来了。对我来说这点比那些漂亮的跑分更打动人,毕竟真实工程里,稳定和可复现比峰值分数重要太多了。 -
Evelyn_Collins_X3—凌晨刷到 Vertex 目录里蹦出 Claude-Opus-5,直接精神了。 -
P1JFWFQ0—绝了,这更新节奏,Anthropic 是真按月发模型啊。 -
Heather.Lee520761—重度用户表示:能力我一点不担心,我担心的是 Max 套餐里重任务一分钟掉 2% 额度那档子事会不会在 Opus 5 上原样重演。半价固然好,可要是任务照样膨胀,省下来的钱分分钟又烧回去,希望官方这次真能把 token 效率做扎实,而不只是把标价砍一半糊弄人。 -
wiipreh—别被英文媒体带偏,好几篇把 Fable 5 的 $10/$50 和安全路由细节硬安到 Opus 5 头上,信息差有点大。 -
Kelly_Collins_202264—等实测,先观望。 -
redelephant244—同底座那个模型无脚手架盲打通关宝可梦的 demo 我看了三遍,视觉推理是真的进化了。