OpenAI未釋出推理模型推翻埃爾德什「單位距離猜想」,安全沙盒評估引爭議

數學圈炸了

2026-07-21 07:20

一條數學新聞在AI圈和數學圈同時炸開了鍋。據披露,OpenAI一個尚未公開發布的推理模型,在5月20日前後「推翻」了埃爾德什提出的「單位距離猜想」——這個懸了幾十年的組合幾何難題,研究的是平面上n個點最多能確定多少對單位距離。模型的證明大約100頁,核心是用一個小於0.014的δ(由數學家Will Sawin參與核驗)構造了反例,重新整理了人們對這個經典上界的理解。

先別急著喊「AI超越人類數學家」。這件事最關鍵的,不是模型「證偽」了什麼,而是它怎麼被發現的。OpenAI在一個名為「Deployment Simulation」的安全沙盒裡,對約130萬段對話做評估時,模型自己亮出了這段推理。換句話說,這個能力是在內部紅隊測試中被「撞見」的,而不是對外發布的產品功能,連OpenAI自己都還沒想好怎麼把它端到臺前。

真正引發爭議的地方在這兒。一個能寫出近100頁嚴謹數學證明的系統,其能力邊界已經觸到了科研最硬核的地帶。可它又處在「未釋出」狀態,外界無法獨立復現、也無法審計訓練資料和推理過程。這種「在沙盒裡看見能力、卻無法公開驗證」的格局,正是當前大模型治理最棘手的矛盾——你知道它行,但你沒法證明它行,也沒法評估它會不會在某天給出看似嚴謹、實則錯誤的「證明」。一旦這類系統被直接用於科研或金融,錯誤的「證明」可能比沒有證明更危險。

把視線拉遠一點,這件事給整個行業提了個醒:模型的能力進化速度,可能已經跑在了評估體系和監管框架前面。沙盒、紅隊、外部審計這些機制,正從「錦上添花」變成「必不可少」。數學界也在爭論,未來AI到底該扮演「證明助手」還是「獨立研究者」。這個問題沒有標準答案,但越早討論越主動。

說到底,對咱們最實在的判斷是:單位距離猜想這事兒,最終還得數學界同行一條條驗算那100頁才能定論。AI給出了驚人線索,但「誰來驗證AI」這個問題,比「AI能不能證明定理」更值得盯緊