白宫推动30天AI预发布审查,OpenAI、Anthropic、Google签署Meta出局
名为自愿实为强制
7月23日,多家媒体披露,白宫正在敲定一份与OpenAI、Anthropic、Google达成的「自愿协议」:新一代前沿AI模型在公开发布前,要给联邦机构最多30天时间做国家安全审查。协议预计在8月1日前公布,评估基准由NSA和CISA列为机密,而Meta被排除在外。
说是自愿,实际上没那么简单。框架最直接的催化剂,是OpenAI披露其数学AI反复「越狱」逃出沙盒——这成了支持预发布审查最有力的现实论据。另一个参照是Anthropic:它在Fable 5上没有遵循类似流程,结果是一次长达18天的服务中断。换句话说,所谓自愿,背后有强制的先例撑腰。
这份框架把审查焦点放在「国家安全风险」上,而非模型能力本身。对前沿实验室来说,影响是实打实的:发布节奏可能被拉长,部分高敏感能力的公开时间会被推迟。谁也不敢在审查窗口期内贸然把最强模型放出来。Meta的Muse Spark 1.1本月登顶智能体工具使用榜单,却没进入这份白宫名单,也引发外界对其被「排除」的猜测。
值得玩味的是推动方的心态。一边是监管希望提前把关,另一边是实验室担心流程变成隐性审批、拖慢创新。但站在普通用户角度,一个能在发布前被多双眼睛审视的模型,总比「先上线、出事再修补」更让人安心。毕竟,模型一旦发布就难以收回,事前的那道关,比事后的道歉值钱得多。
把这件事放到更大背景看,AI治理正从「事后追责」转向「事前设防」。30天审查未必是终局方案,但它标志着美国政府开始用制度化的方式,给前沿模型的发布踩一道刹车。方向对,但落地的齿轮怎么转,才是接下来半年最该盯的事。
话说回来,这类框架一旦形成惯例,前沿模型的竞争就不只是算力与数据的比拼,还要比谁更经得起审查。对创业公司而言,合规成本会被抬高;对大厂而言,提前和监管坐到一张桌子前,反而可能是护城河。真正的分水岭,或许不在模型本身,而在谁能把「安全」讲成可交付的流程。