Claude Opus 5

Anthropic 2026 年 7 月推出的新一代 Opus 旗舰模型,主打百万级上下文与超强 agentic 编码,被官方称为全球最强编程模型,以约一半的价格逼近 Fable 5 的能力

詳細レポート

  • Claude Opus 5 は、Anthropic が 2026 年 7 月に発売した新世代の Opus フラッグシップ モデルです。公式の中核となるステートメントは非常に単純明快で、ほとんど挑発的です - 「世界で最も強力なプログラミング モデル」。それは、今年の Anthropic の集中的なモデル攻勢の終わりに現れます。Opus 4.8 (5 月 28 日)、神話的な Fable 5 / Mythos 5 (6 月 9 日)、および Sonnet 5 (6 月 30 日) がすべて公開されました。オーパス 5 は、フラッグシップ シーケンスの中で最も重要なリンクを構成しています。その位置付けは、単に機能を積み重ねることではなく、Fable 5 の「神話的な」プログラミングと長期的な自律機能を、より手頃な価格でセキュリティの低下が少ない状態に戻すことです。これは、百万レベルのコンテキスト、スーパー エージェント コーディング、およびより優れたトークン エコノミクスに焦点を当てており、OpenAI によってリリースされたばかりの GPT-5.6 を直接ベンチマークしています。

  • Anthropic は、Amazon と Google という 2 つの主要投資家が支援する、現在 OpenAI と真っ向から競合している大手 AI 企業です。 2026年上半期には「毎月発売モデル」のリズムに入った。エンタープライズレベルの信頼性とセキュリティの評判により、商用化の成長率により、一時は評価水準が OpenAI を上回りました。 Opus シリーズは常に Anthropic の最も強力なシリーズであり、複雑な推論、長いコンテキスト、高度なコーディング、自律エージェントのワークフローに特化しています。 Opus 4.6 から 4.8 までの主な方針は、「より誠実で、コードの欠陥の見逃しが少なく、動的なワークフローと労力のギア制御」です。 Opus 5 のデビューは非常にドラマチックでした。 7 月 9 日、コード名「Honeycomb」というモデルが Cursor に一時的に出現し、コミュニティによって Opus 5 の前哨基地として解釈されました。7 月 15 日の早朝、「Claude-Opus-5」エントリが Google Vertex AI のモデル ディレクトリに直接出現し、開発者によって傍受され、その存在が確認されました。多くのメディアは、これを Sonnet 5 と Fable 5 の間の「サブフラッグシップ」と位置づけています。パフォーマンス ベンチマークは Opus 4.8 をわずかに上回っており、Fable 5 に近いですが、コストは約半分しか使用せず、製品ラインの最大の価格性能差を正確に埋めています。

  • Opus 5 の最大の魅力はプログラミングです。 Anthropic はこれを直接「世界最高のプログラミング モデル」と呼んでおり、実際のソフトウェア エンジニアリングの信頼性に焦点を当てています。つまり、見落とされるコード欠陥の減少、より​​強力な複数ステップの計画、コンピュータの使用とブラウザ エージェント、およびバックグラウンドで長時間継続的かつ自律的に実行できる長期タスクです。参考までに、同じベースの Fable 5 は SWE ベンチ Pro で 80.3% まで急上昇し、GPT-5.5 の 58.6% を大幅に上回りました。 Stripe の 5,000 万行の Ruby コード ライブラリでは、エンジニアリング チームが 2 か月以上かかったライブラリ全体の移行が 1 日に短縮されました。 Opus 5 は、同じ技術的ルートをたどって、この機能をより包括的で安定したものにします。 コンテキストもまた大きな飛躍です。噂やリークは一貫して、100 万トークンレベルの標準コンテキストを示しており、適応的思考 (デフォルトで有効) とマルチレベルの作業レベル (xhigh を含む) により、コードベース全体、非常に長い法律文書や研究文書を 1 つのセッションで飲み込むことができます。 Opus 4.8 の動的なワークフローと並列サブエージェント機能を継承しており、漠然とした目標をリサーチ、アウトライン作成、コーディング、テストの実行、自己校正、およびエラー修正の完全なチェーンに分解できます。ウォートンスクールのイーサン・モリック教授は、同時代のモデルをテストした際に広く流布した判断を下した。人間とモデルのコラボレーションのパラダイムは逆転しており、ユーザーは一文ごとに「呪文を唱える」必要がある「魔法使い」から、最終製品に署名するだけの「当事者A」に変わった――10ページ以上の設計書を提出し、数時間後に戻ってくると高品質の完成品を受け取ることになる。 ビジョンとマルチモダリティもオンラインです。同じベースのモデルは、外部の足場がなく、オリジナルのゲームのスクリーンショットのみを使用して独立して「ポケモン」を推測して渡すことができ、ビジュアル ドキュメント推論ベンチマークでも GPT-5.5 および Gemini 3.1 Pro よりも大幅に優れています。 Opus 5 は視覚入力機能を継続し、高解像度と継続的な視覚的推論のさらなる向上が期待されています。

  • これは Opus 5 の最も賢明な策です。 Fable 5 は、入力 100 万件あたり 10 ドル、出力 100 万件あたり 50 ドルと、Opus 4.8 (入力 5 ドル、出力 25 ドル) の完全に 2 倍であり、少数の高価値企業顧客だけにとって十分な高価なものとなっています。 Opus 5 は一般に、「半額、体験の 90%」に焦点を当て、Opus の価格帯かそれより若干高い価格になることが予想されます (業界の推定では、インプットが約 5 ~ 8 ドル、アウトプットが約 25 ~ 40 ドル)。これは、Claude API およびエンタープライズ サブスクリプション レイヤーに対してオープンであり、プロンプト ワード キャッシュおよびバッチ処理インターフェイスと連携して、高頻度の呼び出しのコストをさらに削減します。言い換えれば、Anthropic は、最も高価な層の料金を支払うことなく、Fable 5 に近い機能をより多くの人が利用できるようにしたいと考えています。

  • 開発者コミュニティは、この製品ラインの全体的な機能を高く評価しています。 「世界最高のプログラミング モデル」という言葉が最初に生まれたのは、エブリー CEO のダン シッパー氏が同世代のモデルの実測値に関する長い投稿から来ました。肯定的なフィードバックは、昼も夜も続く超長時間の自律タスクを処理する能力、たった 1 つのプロンプトの単語で完全で提供可能なアプリケーションを生成する能力、コンテキストの統合、および驚くべき「問題解決のセンス」に焦点を当てています。 しかし、実際の使用における苦情も非常に集中しており、ほとんどすべてが Fable 5 世代の古い問題、つまり高価、トークンの書き込み、速度に関係しています。誰かが「The Sims」プロジェクトの Web バージョンを作成するために高負荷モデルを使用したことに対して 100 ドルの請求書を投稿しました。また、Max 20x プランで高負荷のタスクが 1 分ごとにクレジットの約 2% を失うことに気づいた人もいます。ダン・シッパーの「日常の執筆に使用するのは、アリをロケットランチャーで撃つようなものだ」という格言は広く知られています。 Opus 5 の半額ポジショニングは、この問題点を狙ったものですが、単に単価を半分にするだけでなく、本当にトークン消費量を削減できるかどうかは、大規模な実際のテストによって検証する必要があります。

  • メディアは一般に、Opus 5 を OpenAI GPT-5.6 に対する Anthropic の真っ向からの反撃として解釈しています。 GPT-5.6 は以前、コーディングと計算の電力効率の点で Fable 5 を上回ると言われていました。 Opus 5 が何百万ものコンテキストとより優れた経済性を備えて実際に実装されれば、「最も注目されているベンチマーク比較」が Anthropic に戻ることになります。製品ラインから見ると、「Sonnet 5 ボリューム、Opus 5 メインフォース、および Fable 5 トップ構成」の 3 つの階層が完成し、企業は頭脳のない最も高価な階層ではなく、タスクの価値に基づいてルーティング モデルを微調整できます。

  • 1つ目は、「出版する」ということ自体がまだ曖昧であるということです。 7月中旬の時点で、CometAPIやCrypto Briefingなどの情報源は、Anthropicがまだ公式発表を行っていないことを強調している。 Vertex カタログの公開と一部の「すでにオンラインになっている」レポートの間には情報のギャップがあります。一部の英語のレポートでは、Opus 5 の Fable 5 の価格とセキュリティの詳細が誤って記載されており、公式のシステム カードが優先される必要があります。 2 つ目は、セキュリティのダウングレードに伴う経験コストです。高リスクのリクエスト (ネットワーク セキュリティ、生化学、モデルの蒸留) を Opus 4.8 に自動的にルーティングする Fable 5 のメカニズムは、過度に防御的であると批判されています。一部の中国ユーザーは、「こんにちは」と言うと高リスクの警告が表示される可能性があると報告しました。 Opus 5 の安全ガードレールが軽いか、このセットを継続するかは、通常の作業における偶発的な負傷率に直接関係します。 3つ目は、管理不能なコストという構造的な問題です。エージェント ワークフローでは、タスクが自然に一連のサブタスクに拡張されます。単価が半分になることは、総コストが半分になることを意味しません。 Opus 5 は、「中規模のタスクがバックグラウンドで 50 万から 100 万のトークンを静かに燃やしていた」という Fable 5 の時代に学んだ教訓を自動的に免れることはできないかもしれません。

  • チーム全体で数か月の開発を必要とする困難なプロジェクトを克服する必要があるアーキテクト、長期サイクルの独立したエージェントを実行するエンジニアリング チーム、および 1 回のセッションで非常に長いドキュメントを処理する必要がある法律/財務/研究シナリオに適しています。適さない用途: 簡単な Q&A、タイトルの変更、短いコピーの作成など、素早いやり取りが必要な日常業務のみを行う場合 - このようなシナリオでは、Sonnet 5 の方が経済的です。実用的なアプローチは、モデル ルーティング ラダーを構築することです。簡単なタスクには Sonnet 5 を使用し、主要な複雑なタスクには Opus 5 を使用し、使用状況の監視と手動による承認を伴う極端な最先端のタスクには Fable 5 のみを使用します。

  • Claude Opus 5 の価値は、能力の上限を再び更新することではなく、「神話的な」能力を収益性の高いビジネスに変える試み、つまり Fable 5 に近いプログラミングと自律機能を約半額の価格で提供することにあります。公式ベンチマークとトークンの経済的パフォーマンスが噂どおりであれば、2026 年後半には最も複雑なワークロードの新しいデフォルト オプションになる可能性があります。しかし、正式なシステムカードと大規模な実際のテストが実装されるまでは、「世界で最も強力なプログラミングモデル」という言葉は当分の間は静まり返るはずだ。

ユーザーレビュー

  • 头像
    DFoster_2023
    Fable 5 を半額で比較すると、この波は本当に決算方法を知っています。

  • 头像
    JAlin
    公式システム カードを待っていますが、今は Vertex ディレクトリとゴシップのスクリーンショットばかりなので、まだ急いで神になろうとしないでください。

  • 头像
    ACruz_2023
    昨夜、Opus 5 を使用して中規模のノード サービスを再構築しました。コードを読み取り、タスクを分割し、テストを実行し、CI を 3 ラウンド修復してから 1 日終了しました。ずっと画面を見つめてコーヒーを飲んでいました。その半分は世界で最も強力なプログラミング モデルだと私は信じています。残りの半分については、結論を出す前に今月のトークン法案が出るまで待たなければなりません。機能は非常に強力ですが、お金に見合う価値があるかどうかはわかりません。

  • 头像
    Jack_ClarkJr
    ソネット5が人気、オーパス5が主力、フェイブル5がトップモデルです。この 3 層の階層がついに完成し、選択がより明確になりました。

  • 头像
    Angela.Murphy_X
    何百万ものコンテキストは非常に優れており、リポジトリ全体が詰め込まれている場合でも、詳細を覚えておくことができます。

  • 头像
    Melissa_Lopez_75
    私は GPT-5.6 に挑戦し、2 つのスコアが競われるのを待つためにここに来ました。

  • 头像
    流光_8
    ちょっと聞きたいのですが、Opus 5 では、Fable 5 のように「こんにちは」と言うときに危険性の高い警告が流れますか?

  • 头像
    LindaMurphy
    価格が半分になったことは認めますが、一連のエージェント タスクは、ファイルの読み取り、コードの変更、テストの実行、障害の修正、そして自己検証という長い一連のサブタスクに自然に分割され、トークンはまだ燃え続けています。単価が下がったからといって、総額が下がったわけではありません。数十万のトークンを静かに消費していた Fable 5 時代の中規模のタスク バックエンドの教訓はまだ記憶に新しいので、あまり早く喜ぶ必要はありません。

  • 头像
    MarkHughes
    強すぎて戻れない。

  • 头像
    Elizabeth.Walker_66
    カーソルにはハニカムが現れるだろうと予想していましたが、それはオーパス 5 の前哨基地でした。

  • 头像
    JoanHernandez
    私たちのチームは以前、運用環境全体のバグ バックログを同じベース上のモデルに直接スローし、仕事を終えて帰宅しました。翌朝戻ってくると、コールスタック分析が完了し、カバレッジが合格し、PR が引き上げられ、欠陥ライブラリ全体がクリーンアップされていることがわかりました。こういう「朝まで放っておく」ホスト体験はとても楽しいのですが、月末の請求書を見ると泣きそうになります。

  • 头像
    沈玉然
    これを使って毎日のコピーライティングを書くのは、ロケットランチャーを使って蚊をたたくようなものです。私は毎日ワークステーションでダン・シッパーの暴言を繰り返しています。

  • 头像
    Logan.Diaz_Max
    実はサブフラッグシップの位置付けが最も現実的だ。ほとんどのタスクでは Fable が完全な状態である必要はないため、Opus 5 が最適です。

  • 头像
    VEtay
    現在中国でOpus 5を呼び出す方法を教えてください。 API を使用する場合でも Vertex に接続する必要がありますか?

  • 头像
    sadrabbit530
    Opus 4.8 から Opus 5 に移行した後、同じエージェント スクリプトのセットでは明らかに「見落とされる落とし穴」が減り、複数ステップの計画がより安定し、途中でクラッシュする長いタスクの数やコンテキスト ドリフトの数が目に見えて減少しました。私にとって、これはそれらの美しいランニングスコアよりも印象深いものです。結局のところ、実際のプロジェクトでは、ピークスコアよりも安定性と再現性の方がはるかに重要です。

  • 头像
    Evelyn_Collins_X3
    早朝に Vertex ディレクトリを参照すると、Claude-Opus-5 がポップアップ表示され、すぐに元気になりました。

  • 头像
    P1JFWFQ0
    驚くべきことに、この更新リズムで、Anthropic は本当に毎月モデルをリリースします。

  • 头像
    Heather.Lee520761
    ヘビーユーザーはこう言いました:能力についてはまったく心配していません。私が心配しているのは、Max パッケージの重いタスクで 1 分あたり 2% の信用損失が Opus 5 でも再び発生するかどうかです。半額は良いですが、タスクが増え続けると、節約されたお金が 1 分ごとに焼き戻されてしまいます。今回は、人々を騙すために単に価格を半額にするのではなく、公式が本当にトークンの効率をよりしっかりとしたものにしてくれることを願っています。

  • 头像
    wiipreh
    英語のメディアに偏見を持たれないでください。いくつかの記事では、Fable 5 の $10/$50 とセキュア ルーティングの詳細を Opus 5 に押し付けています。情報のギャップは少し大きいです。

  • 头像
    Kelly_Collins_202264
    実際のテストを待っていますので、様子を見ましょう。

  • 头像
    redelephant244
    足場なしのポケモンのブラインドプレイとして、同じ台で同じ機種のデモを3回観ましたが、視覚的な推理が本当に進化していました。