Claude Mythos
Anthropic の最も強力な AI 最先端モデルは一般公開されておらず、Project Glasswing を通じてパートナーのみが利用できます。
詳細レポート
-
Claude Mythos Preview は、Anthropic が 2026 年 4 月 7 日にリリースした新しい最先端 AI モデルです。Claude 製品ラインの最上位に位置し、その性能は既存の Opus シリーズを大きく上回ります。このモデルは、SWE ベンチ検証で 93.9%、GPQA ダイヤモンドで 94.6% のスコアを獲得し、Anthropic のこれまでで最も強力なモデルとなっています。ただし、セキュリティ上の懸念により、このモデルは一般公開されておらず、Project Glasswing プログラムを通じて一部のパートナーのみが利用できます。
-
Anthropic は、信頼性が高く、説明可能で制御可能な AI システムの構築に特化した AI セキュリティおよび研究会社です。同社は2021年に設立され、米国サンフランシスコに本社を置いています。主な創設者は OpenAI の主要従業員です。 Anthropic は AI に合わせた研究を中核に据えており、その Claude ファミリーのモデルは安全性と推論機能において業界のリーダーとなっています。 2026 年 4 月 7 日、Anthropic は Apple、Nvidia、Microsoft、Amazon Cloud Service (AWS)、Google、Linux Foundation を含む 11 のテクノロジー巨人と提携して Project Glasswing プロジェクトを立ち上げ、Claude Mythos Preview をリリースしました。このモデルの内部コード名は「Capybara」です。この名前は、「物語/言説」を意味する古代ギリシャ語の「Mythos」に由来しており、人類文明が世界を理解するための物語体系を指します。
-
Claude Mythos Preview は、セキュリティと一般的な側面の両方で優れた機能を実証しました。セキュリティの面では、このモデルは、すべての主流のオペレーティング システムとブラウザで数千の高リスクのゼロデイ脆弱性を検出できます。ブラウザの脆弱性エクスプロイトとリモート コード実行エクスプロイトを個別に作成できます。複数の脆弱性を連続して接続し、一般ユーザーから root への権限昇格チェーンを実現できます。また、逆シンボルテーブルバイナリを再構築して活用することもできます。これらの能力は特別に訓練されたものではなく、コーディングと推論の総合的な向上の自然な結果として現れます。 全体的な方向性という点では、Claude Mythos Preview も同様に優れたパフォーマンスを発揮します。このモデルは SWE ベンチ検証で 93.9% のスコアを獲得し、コード生成と修復の点で業界最高のランクにランクされました。学術的推論の観点からは、GPQA Diamond のスコアは 94.6%、ターミナルベンチ 2.0 のスコアは 82.0%、BrowseComp のスコアは 86.9% で、トークンの消費量は Opus 4.6 のわずか 5 分の 1 であり、効率の大幅な向上を反映しています。 技術的な能力に応じて、ユーザー エクスペリエンスにも制限が生じます。ユーザーは Claude Mythos Preview に直接アクセスすることはできず、Project Glasswing プログラムのパートナーを経由する必要があります。現在、Google Cloud Vertex AI (プライベート プレビュー)、Amazon Bedrock、Microsoft Foundry の 3 つのチャネルを通じてアクセスできます。
-
Claude Mythos Preview の価格設定メカニズムはより複雑です。公開された情報によると、このモデルの標準価格は、インプットの場合は 100 万トークンあたり 25 米ドル、アウトプットの場合は 100 万トークンあたり 125 米ドルで、Opus 4.6 のインプットの 15 米ドルとアウトプットの 75 米ドルと比較すると、約 67% の増加となります。ただし、これは 1 億ドルの割り当てを使い切った後の標準価格であり、パートナーは最初は Anthropic が提供する割り当てを使用できます。 Anthropic はモデルの使用に最大 1 億ドルをコミットしており、Linux Foundation の下で Alpha-Omega と OpenSSF に 250 万ドル、Apache Software Foundation に 150 万ドルを寄付しています。このビジネス モデルは、一般の個人ユーザーではなく、主に企業レベルのパートナーを対象としています。
-
Claude Mythos Preview は一般公開されていないため、一般のユーザーが直接体験することはできず、ユーザーによる広範なレビューはありません。しかし、業界の反応を見ると、このモデルのリリースに関して 2 つの異なる見解があります。 Anthropic はリスクの高い AI 機能を責任を持って扱っており、このアプローチは評価に値すると主張する人もいます。 「謎」によってブランド価値を高めるマーケティング戦略であるという見方もある。これがAI企業がどの機能が「危険すぎる」かを一方的に決定し、公表しない前例となるのではないかと心配する人もいる。 別の見方は、Claude Mythos Preview が公開されない根本的な理由は「それほど危険ではない」かもしれないが、Anthropic はそれを差別化された競争上の利点として利用し、企業協力を通じてより高い利益を獲得したいと考えているというものです。いずれにせよ、一般ユーザーからの実際の使用状況のフィードバックが不足しているため、これらの意見は推測のレベルにとどまります。
-
業界の観点から見ると、Claude Mythos Preview のリリースは、最先端の AI モデルの競争における新たな段階を示しています。このモデルのスコアは SWE ベンチ検証で 93.9% であり、Opus 4.6 の 80.8% と比較して 13.1 パーセント ポイント向上しました。 AI モデルの評価史上、このようなギャップはまれです。 GPQA ダイヤモンド スコアは 94.6% で、優れた学術的推論能力を示しています。 しかし、このモデルを一般公開しないという戦略は、業界の考え方を引き起こすきっかけにもなりました。最も強力な AI 機能が少数のテクノロジー巨人の手だけにある場合、新たなテクノロジーの独占が生まれるでしょうか? Project Glasswing の 12 のコア パートナーには、AWS、Apple、Broadcom、Cisco、CrowdStrike、Google、JPMorganChase、Linux Foundation、Microsoft、NVIDIA、Palo Alto Networks、および Anthropic 自体が含まれており、クラウド サービス、携帯電話チップ、ネットワーク セキュリティ、金融などの多くの主要分野をカバーしています。この協力モデルが AI 分野におけるマシュー効果を悪化させるかどうかは、引き続き注目に値します。
-
Claude Mythos Preview に関する最大の論争は、その「非公開」戦略です。 Anthropic 社の公式説明では、このモデルのセキュリティ機能は強すぎるため、攻撃者の手に渡った場合の結果は深刻であるため、新しいセキュリティ ガードレールの開発が完了するまで公開するのは適切ではない、とされています。この説明の妥当性については議論の余地がある。支持者はこれが責任あるアプローチだと主張し、反対者はビジネスの策略だと主張する。 リスクの観点から見ると、最も強力な AI システムが少数の機関のみによって管理されている場合、複数のリスクが生じる可能性があります。 1 つ目は、少数の企業が AI 機能について発言権を持つ可能性があるため、技術独占のリスクです。第二に、セキュリティ審査のリスクがあります。 AI企業はどの機能が「危険すぎる」かを一方的に判断し、公表しないことができる。これには透明性のある監視メカニズムが欠けています。 3 つ目は、能力ギャップのリスクです。最先端モデルとパブリックモデルとの格差が拡大し続ければ、AI分野の二極化につながる可能性がある。
-
Claude Mythos Preview は、一般の個人ユーザーには適していません。まず、モデルは公開されておらず、個人ユーザーが直接アクセスすることはできません。第二に、たとえ協力的なチャネルを通じてアクセスしたとしても、その価格は高い (100 万トークン出力あたり 125 ドル) ため、個人ユーザーには適していません。第三に、このモデルは主にセキュリティ研究とエンタープライズレベルのアプリケーションを指向しており、個々のユーザーが適切なアプリケーションシナリオを見つけるのが困難です。 企業ユーザーの場合、会社が Project Glasswing プログラムまたは重要インフラストラクチャ組織のパートナーである場合は、アクセスの申請を検討できます。このモデルは、高強度のコード生成、脆弱性マイニング、セキュリティ調査を必要とするエンタープライズ レベルのアプリケーション シナリオに適しています。平均的なビジネス ユーザーや個人ユーザーにとっては、Claude Opus 4.7 または Opus 4.6 がより実用的な選択肢であり、これらのモデルは公開されているモデルの中で依然としてトップに位置しています。
-
Claude Mythos Preview は、Anthropic がこれまでにリリースした最も強力な AI モデルであり、コード生成、学術的推論、セキュリティ研究などの複数の側面で優れた機能を実証しています。ただし、セキュリティ上の懸念により、このモデルは一般公開されておらず、Project Glasswing プログラムを通じて一部のパートナーのみが利用できます。この戦略は、AI の安全性、技術の独占、責任あるイノベーションに関する業界の議論を引き起こしました。このモデルにアクセスできない通常のユーザーにとって、現在公開されている最良のオプションは依然として Claude Opus 4.7 です。 AI 安全ガードレール技術の開発に伴い、Anthropic は将来その機能の一部を段階的に公開すると予想されますが、このプロセスには長い時間がかかる可能性があります。
ユーザーレビュー
-
GammaGainRivera—SWEベンチスコア93.9%もひどい。以前は、Opus 4.6 には 80.8% しかありませんでした。この改善は競合製品よりもはるかに進んでいます。 -
月光_13—Mythos は使用されていませんが、この 244 ページのシステム カードを見ると、Anthropic が今回本当に多額の費用を費やしたことがわかります。技術レポートは論文よりも詳細です。 -
WKimQ—率直に言って、ハッキングされて悪いことに利用されるのを恐れて、あえて公開しません。この論理は理解できますが、開発者としてはやはり羨ましいです。 -
DouglasButler_2020—GPQA ダイヤモンドの 94.6% を見たとき、これは基本的に地球上で最も強力な学術的推論モデルであると確信しました。 -
j4b4ynj11—最も面白いのは、このモデルが非常に強力であるため、自分の会社ですらそれを使用する勇気がないため、名前を「Claude Don't Use」に変更することを提案したことです。 -
GloriaCampbellII129—Anthropic が大勝負をしているような気がします。まずは非公開のスーパーモデルを作成し、徐々に許可を解放していくという。私はこのマーケティングの波を全面的に評価しています。 -
Caroline979—BrowseComp は、より高い結果を達成するために、Opus 4.6 のトークンの 5 分の 1 のみを使用します。この効率化はちょっととんでもないですね。 -
悠然64—隣の GPT-5.4 Pro は依然として Opus 4.6 と競合していますが、ここでは Mythos がすでに独自のゲームをプレイしています。 -
jbzo4i—Huxiu の分析を読んだ後、このモデルには感情的な反応と倫理的な意思決定能力があると言われました。これは、それについて考える上で最も恐ろしい部分です。 -
刘凤—公開しないのが良いです。公開しないと、さまざまな即時攻撃によって侵入されてしまいます。 -
Terry.Howard369675—結局のところ、安全が第一であり、アンスロピックは前の事件に怯えていました。 -
MrFinnMoore_dev—一般ユーザーは諦めることを強くお勧めします。 Project Glasswing パートナーのリストには、個人ユーザーが入る余地はありません。 -
BeverlyKing16822—将来的には Opus 5 が Mythos の機能を継承できることを願っています (10% でも十分です)。 -
Diana.Lee1684—死ぬほど笑ってしまうと、このシリーズを買う余裕すらありません。生産高は 100 万トークンあたり 125 米ドルで、大手メーカーだけが買える価格です。 -
马涛军—実際、それを公開しないのは正しいことです。本当に放っておくと何か問題が起こるかもしれません。 AI の安全性は何よりも重要です。 -
Deborah302—非常に良いです。Claude Opus 4.7 は依然としてパブリック チャネルで使用できる最も強力なものであり、それで十分です。 -
Amber_RobertsX044—評価データを見てみると、 Terminal-Bench 2.0 のスコアは 82% と予想より高かったです。 -
DeFiGuru923—テクノロジー大手5社が共同でこれを支持しており、この戦いは大きすぎる。 -
兰花774—内部コード名は Capybara です。プロダクトマネージャーが何を考えているかはわかりません。 -
Christian.Foster520—防御的なネットワーク セキュリティ ワークフロー向けに設計されていると言われていますが、攻撃的な方向性はどうなのでしょうか?あえて全く考えないことにします。