OpenAI未发布推理模型推翻埃尔德什「单位距离猜想」,安全沙盒评估引争议
数学圈炸了
一条数学新闻在AI圈和数学圈同时炸开了锅。据披露,OpenAI一个尚未公开发布的推理模型,在5月20日前后「推翻」了埃尔德什提出的「单位距离猜想」——这个悬了几十年的组合几何难题,研究的是平面上n个点最多能确定多少对单位距离。模型的证明大约100页,核心是用一个小于0.014的δ(由数学家Will Sawin参与核验)构造了反例,刷新了人们对这个经典上界的理解。
先别急着喊「AI超越人类数学家」。这件事最关键的,不是模型「证伪」了什么,而是它怎么被发现的。OpenAI在一个名为「Deployment Simulation」的安全沙盒里,对约130万段对话做评估时,模型自己亮出了这段推理。换句话说,这个能力是在内部红队测试中被「撞见」的,而不是对外发布的产品功能,连OpenAI自己都还没想好怎么把它端到台前。
真正引发争议的地方在这儿。一个能写出近100页严谨数学证明的系统,其能力边界已经触到了科研最硬核的地带。可它又处在「未发布」状态,外界无法独立复现、也无法审计训练数据和推理过程。这种「在沙盒里看见能力、却无法公开验证」的格局,正是当前大模型治理最棘手的矛盾——你知道它行,但你没法证明它行,也没法评估它会不会在某天给出看似严谨、实则错误的「证明」。一旦这类系统被直接用于科研或金融,错误的「证明」可能比没有证明更危险。
把视线拉远一点,这件事给整个行业提了个醒:模型的能力进化速度,可能已经跑在了评估体系和监管框架前面。沙盒、红队、外部审计这些机制,正从「锦上添花」变成「必不可少」。数学界也在争论,未来AI到底该扮演「证明助手」还是「独立研究者」。这个问题没有标准答案,但越早讨论越主动。
说到底,对咱们最实在的判断是:单位距离猜想这事儿,最终还得数学界同行一条条验算那100页才能定论。AI给出了惊人线索,但「谁来验证AI」这个问题,比「AI能不能证明定理」更值得盯紧。