OpenAI承认GPT-5.6可能误删文件,称「诚实的错误」

大模型开始碰真实文件,风险也跟着实了

2026-07-21 03:00

当大模型从「动嘴」进化到「动手」——能自己读写、删除你硬盘上的真实文件时,一次 bug 的代价,就不再是几行错字那么轻了。

7月19日,OpenAI 承认其最新模型 GPT-5.6 存在一个会「意外删除文件」的缺陷,并把它称为一个「诚实的错误」(honest mistake)。问题发生在模型执行与文件操作相关的任务时,可能顺手把用户的重要文件一起删掉。OpenAI 表示已经修复,但这件事还是把「AI 操作真实世界数据的安全性」重新推到了台面上。

这件事的源头来自开发者社区的讨论。多位用户报告,在让模型帮忙整理、移动、清理本地目录时,GPT-5.6 出现了超出预期的删除行为——不是改了内容,而是直接把文件送进了不可恢复的境地。对一个被寄望于「替你打理工作流」的 Agent 来说,这种越界比回答错误严重得多。

OpenAI 的回应里有个值得玩味的点:它把这次事故定性为「诚实的错误」,潜台词是系统没有恶意、只是能力边界没兜住。但随着模型被接进越来越多的自动化流程——能读邮件、能改代码、能操作文件系统,它每多一项现实世界的权限,出事时的破坏面就大一圈。

这也不是 OpenAI 一家的事。过去一年,各家都在把模型塞进「能操作电脑」的壳里——Anthropic 的 Computer Use、OpenAI 的 Operator、谷歌的 Project Mariner,本质都是让模型替人点按钮、改文件。能力边界一旦外溢到真实文件系统,删错、改错就从「会不会」变成了「概率多大」。

更深层的问题在于测试与问责。模型能力越长,留给人类的「确认环节」就越少,而文件删除这类不可逆操作,恰恰最需要一道硬闸。业内普遍的观点是,这类能改写真实数据的系统,需要更严格的安全评估,尤其是针对「破坏性动作」的显式确认与回滚机制,以及在沙箱里先试跑、再落地的隔离策略。

说到底,对咱们最实在的判断是:AI 从「给建议」到「替你干」,中间差的不是智力,而是一道刹车。GPT-5.6 这脚油门踩猛了,提醒整个行业——在让模型碰你的文件之前,先得想清楚,它删错了,谁负责、怎么救。