未来生命研究所2026 AI安全指数:最高仅C+,无人通过

全班都不及格的体检

2026-07-16 04:06
未来生命研究所2026
未来生命研究所2026

7月15日,未来生命研究所(Future of Life Institute)甩出了一份2026 AI安全指数,给全球最头部的一批AI实验室打了分。结果有点扎心:全场最高分只是Anthropic拿到的C+,OpenAI和Google DeepMind都是C,Meta是D+,xAI、DeepSeek、Mistral则基本等于不及格。

这份指数不看模型跑分,看的是另一套东西:各家怎么管理风险、够不够透明、有没有真的兑现自己公开讲过的安全承诺。换句话说,它给的不是「模型强不强」,而是「实验室靠不靠谱」。

真正值得玩味的是报告里的一句话:好几家实验室在早前做出安全承诺后,已经悄悄往回缩了——而且往往发生在它们融资的时候。这话分量不轻。安全承诺在融资PPT里最漂亮,等钱到账、竞争压力上来,最先被牺牲的常常就是它。

把视角拉回行业。C+能当全班第一,本身就说明问题:哪怕是最「安全派」的实验室,按它自己的标准也只是勉强及格。当这些系统正被接进网络安全、医疗审核、自动驾驶这些要命的场景,一份「全班都不及格」的体检报告,比任何自卖自夸的安全博客都更有参考价值。

话说回来,这份指数也不是没有争议。打分的口径由研究所自己定,实验室们未必服气。可它至少做对了一件事:把「安全」从实验室的自说自话里拽出来,交给第三方用同一把尺子量。

真正值得关注的,其实是监管和资本会不会真的把这把尺子当回事。如果评分只是年度报告里的一页,那它再尖锐也改变不了什么;只有当它影响采购、影响牌照、影响融资条款,实验室才会真正把承诺当承诺。

说到底,对咱们普通用户最实在的提醒是:别光看模型多能聊,也得问问背后那家公司,对自己造出来的东西到底负不负责。