未來生命研究所2026 AI安全指數:最高僅C+,無人透過
全班都不及格的體檢
2026-07-16 04:06

7月15日,未來生命研究所(Future of Life Institute)甩出了一份2026 AI安全指數,給全球最頭部的一批AI實驗室打了分。結果有點扎心:全場最高分只是Anthropic拿到的C+,OpenAI和Google DeepMind都是C,Meta是D+,xAI、DeepSeek、Mistral則基本等於不及格。
這份指數不看模型跑分,看的是另一套東西:各家怎麼管理風險、夠不夠透明、有沒有真的兌現自己公開講過的安全承諾。換句話說,它給的不是「模型強不強」,而是「實驗室靠不靠譜」。
真正值得玩味的是報告裡的一句話:好幾家實驗室在早前做出安全承諾後,已經悄悄往回縮了——而且往往發生在它們融資的時候。這話分量不輕。安全承諾在融資PPT裡最漂亮,等錢到賬、競爭壓力上來,最先被犧牲的常常就是它。
把視角拉回行業。C+能當全班第一,本身就說明問題:哪怕是最「安全派」的實驗室,按它自己的標準也只是勉強及格。當這些系統正被接進網路安全、醫療稽核、自動駕駛這些要命的場景,一份「全班都不及格」的體檢報告,比任何自賣自誇的安全部落格都更有參考價值。
話說回來,這份指數也不是沒有爭議。打分的口徑由研究所自己定,實驗室們未必服氣。可它至少做對了一件事:把「安全」從實驗室的自說自話裡拽出來,交給第三方用同一把尺子量。
真正值得關注的,其實是監管和資本會不會真的把這把尺子當回事。如果評分只是年度報告裡的一頁,那它再尖銳也改變不了什麼;只有當它影響採購、影響牌照、影響融資條款,實驗室才會真正把承諾當承諾。
說到底,對咱們普通使用者最實在的提醒是:別光看模型多能聊,也得問問背後那家公司,對自己造出來的東西到底負不負責。