Claude Mythos

Anthropic 最強 AI 前沿模型,不對外公開發布,透過 Project Glasswing 僅向合作方提供

深度報告

  • Claude Mythos Preview 是 Anthropic 於 2026 年 4 月 7 日釋出的全新前沿 AI 模型,定位為 Claude 產品線的最高層級,效能遠超現有 Opus 系列。該模型在 SWE-bench Verified 得分 93.9%,GPQA Diamond 得分 94.6%,是 Anthropic 迄今最強模型。然而,出於安全考慮,該模型不對外公開發布,僅透過 Project Glasswing 計劃向特定合作方提供使用許可權。

  • Anthropic 是一家 AI 安全和研究公司,致力於構建可靠、可解釋、可控制的 AI 系統。公司成立於 2021 年,總部位於美國舊金山,主要創始人來自 OpenAI 的關鍵員工。Anthropic 以 AI 對齊研究為核心特色,其 Claude 系列模型在安全性和推理能力方面一直處於行業領先地位。2026 年 4 月 7 日,Anthropic 聯合蘋果、英偉達、微軟、亞馬遜雲服務(AWS)、谷歌、Linux 基金會等 11 家科技巨頭,啟動 Project Glasswing 專案,併發布 Claude Mythos Preview。該模型內部代號為「Capybara」,名稱來源於古希臘語「Mythos」,意為「敘述/話語」,指人類文明理解世界的故事體系。

  • Claude Mythos Preview 在安全方向和通用方向兩個維度都展現出卓越能力。在安全方向上,該模型能夠在所有主流作業系統和瀏覽器中發現數千個高危零日漏洞,可自主編寫瀏覽器漏洞利用和遠端程式碼執行 exploit,能夠串聯多個漏洞實現從普通使用者到 root 的許可權提升鏈,還能夠對去符號表二進位制進行重構和漏洞挖掘。這些能力不是專門訓練的,而是 coding 和 reasoning 全面提升的自然結果湧現。 在通用方向上,Claude Mythos Preview 的表現同樣出色。該模型在 SWE-bench Verified 得分 93.9%,在程式碼生成和修復方面處於業界最高水平。在學術推理方面,GPQA Diamond 得分 94.6%,Terminal-Bench 2.0 得分 82.0%,BrowseComp 得分 86.9% 且 token 消耗僅為 Opus 4.6 的五分之一,體現了顯著的效率提升。 與技術能力相對應的是使用體驗方面的限制。使用者無法直接訪問 Claude Mythos Preview,必須透過 Project Glasswing 計劃的合作方才能使用。目前可透過 Google Cloud Vertex AI(Private Preview)、Amazon Bedrock 和 Microsoft Foundry 三個渠道接入。

  • Claude Mythos Preview 的定價機制較為複雜。根據披露的資訊,該模型的標準價格為輸入每百萬 tokens 25 美元,輸出每百萬 tokens 125 美元,相比 Opus 4.6 的輸入 15 美元、輸出 75 美元漲幅約 67%。不過,這是 1 億美元額度用完後的標準價格,合作方初期可使用 Anthropic 提供的額度。Anthropic 承諾投入最多 1 億美元模型使用額度,並捐款 250 萬美元給 Linux Foundation 下的 Alpha-Omega 和 OpenSSF,150 萬美元給 Apache 軟體基金會。這種商業模式主要面向企業級合作方,而非普通個人使用者。

  • 由於 Claude Mythos Preview 不對外公開發布,普通使用者無法直接體驗,因此沒有廣泛的使用者評價。然而,從行業反應來看,對該模型的釋出存在兩種截然不同的觀點。一部分觀點認為 Anthropic 正在負責任地處理高風險 AI 能力,這種做法值得肯定。另一部分觀點認為這是營銷策略,透過「神秘感」來提升品牌價值。還有人擔心這開了一個先例:AI 公司可以單方面決定哪些能力「太危險」而不公開。 另一種觀點認為,Claude Mythos Preview 不公開的根本原因可能並非「太危險」,而是 Anthropic 希望將其作為差異化競爭優勢,透過企業合作獲取更高收益。無論如何,由於缺乏普通使用者的實際使用反饋,這些觀點都停留在猜測層面。

  • 從行業角度來看,Claude Mythos Preview 的釋出標誌著前沿 AI 模型競爭進入新階段。該模型在 SWE-bench Verified 得分 93.9%,相比 Opus 4.6 的 80.8% 提升了 13.1 個百分點,這一差距在 AI 模型評測歷史上是罕見的。GPQA Diamond 得分 94.6%,展現了卓越的學術推理能力。 然而,該模型不對外公開發布的策略也引發了行業思考。如果最強大的 AI 能力只掌握在少數科技巨頭手中,這是否會形成新的技術壟斷?Project Glasswing 計劃的 12 家核心合作方包括 AWS、Apple、Broadcom、Cisco、CrowdStrike、Google、JPMorganChase、Linux Foundation、Microsoft、NVIDIA、Palo Alto Networks 和 Anthropic 自身,涵蓋了雲服務、手機晶片、網路安全、金融等多個關鍵領域。這種合作模式是否會加劇 AI 領域的馬太效應,值得持續關注。

  • Claude Mythos Preview 最大的爭議在於其「不公開」策略。Anthropic 官方的解釋是該模型的安全能力過強,落入攻擊者手中後果嚴重,因此在新安全護欄開發完成前不適合公開。這一解釋的合理性存在爭議。支持者認為這是負責任的做法,反對方認為這是商業策略。 從風險角度分析,如果最強大的 AI 系統只被少數機構控制,可能會帶來多方面的風險。首先是技術壟斷風險,少數公司可能形成 AI 能力的話語權。其次是安全審查風險,AI 公司可以單方面決定哪些能力「太危險」而不公開,這缺乏透明的監督機制。第三是能力差距風險,如果前沿模型與公開模型的差距持續擴大,可能導致 AI 領域的兩極分化。

  • Claude Mythos Preview 不適合普通個人使用者。首先,該模型不對外公開發布,個人使用者無法直接訪問。其次,即使透過合作渠道接入,其高昂的價格(輸出每百萬 tokens 125 美元)也不適合個人使用者。第三,該模型主要面向安全研究和企業級應用,個人使用者難以找到合適的應用場景。 對於企業使用者,如果所在企業是 Project Glasswing 計劃的合作方或關鍵基礎設施組織,可以考慮申請接入。該模型適合需要高強度程式碼生成、漏洞挖掘、安全研究的企業級應用場景。對於普通企業和個人使用者,Claude Opus 4.7 或 Opus 4.6 是更實際的選擇,這些模型在公開模型中仍然處於最高水平。

  • Claude Mythos Preview 是 Anthropic 迄今釋出的最強 AI 模型,在程式碼生成、學術推理、安全研究等多個維度展現出卓越能力。然而,出於安全考慮,該模型不對外公開發布,僅透過 Project Glasswing 計劃向特定合作方提供。這一策略引發了關於 AI 安全性、技術壟斷和負責任創新的行業討論。對於無法訪問該模型的普通使用者,Claude Opus 4.7 仍是目前公開可用的最優選擇。隨著 AI 安全護欄技術的發展,預計 Anthropic 未來會逐步公開部分能力,但這一程序可能需要較長時間。

使用者評論

  • 頭像
    GammaGainRivera
    93.9%的SWE-bench得分也太恐怖了,之前Opus 4.6才80.8%,這提升幅度直接甩開競品幾條街。

  • 頭像
    月光_13
    雖然用不上Mythos,但看到這份244頁的系統卡就知道Anthropic這次是真下血本了,技術報告做得比論文還詳細。

  • 頭像
    WKimQ
    說白了就是不敢公開,怕被hack了用來做壞事。這個邏輯我能理解,但作為開發者還是很眼紅啊。

  • 頭像
    DouglasButler_2020
    看到GPQA Diamond 94.6%我服了,這基本上已經是地表最強學術推理模型了。

  • 頭像
    j4b4ynj11
    最搞笑的是這模型強到連自己公司都不敢用了,建議改名叫Claude Don't Use。

  • 頭像
    GloriaCampbellII129
    感覺 Anthropic 在下一盤大棋,先弄個超強模型不公開,然後慢慢放許可權,這波營銷我給滿分。

  • 頭像
    Caroline979
    BrowseComp只用了 Opus 4.6 五分之一的 token 達到更高效果,這效率提升有點離譜。

  • 頭像
    悠然64
    人家隔壁GPT-5.4 Pro還在那跟Opus 4.6比劃呢,這邊Mythos已經自己玩自己的了。

  • 頭像
    jbzo4i
    看了 Huxiu 的分析,說這模型有情緒反應和倫理決策能力,這才是最細思極恐的地方。

  • 頭像
    劉鳳
    不公開也挺好的,不然又要被各種prompt攻擊打穿了。

  • 頭像
    Terry.Howard369675
    說到底就是安全第一唄,Anthropic 被之前的事件搞怕了。

  • 頭像
    MrFinnMoore_dev
    強烈建議普通使用者死了這條心,Project Glasswing 合作方名單裡沒有個人使用者的位置。

  • 頭像
    BeverlyKing16822
    期待以後 Opus 5 上能繼承點 Mythos 的能力,哪怕10%也夠用了。

  • 頭像
    Diana.Lee1684
    笑死,根本買不起系列:輸出每百萬tokens 125美元,這價格只有大廠玩得起。

  • 頭像
    馬濤軍
    其實不公開是對的,真要放開指不定出什麼亂子,AI安全比啥都重要。

  • 頭像
    Deborah302
    很好,Claude Opus 4.7 依然是我們在公開渠道能用到最強的,這就夠了。

  • 頭像
    Amber_RobertsX044
    看了評測資料,Terminal-Bench 2.0 82%的成績比我預期的還高。

  • 頭像
    DeFiGuru923
    五大科技巨頭聯合背書,這陣仗也太大了。

  • 頭像
    蘭花774
    內部代號 Capybara 水豚,不知道產品經理怎麼想的。

  • 頭像
    Christian.Foster520
    說是為防禦性網路安全工作流設計,那攻擊性方向呢?完全不敢想。