Anthropic发布Claude Opus 5,80%提示词说删就删
删完了,模型反而更聪明了
Anthropic日前发布了Claude Opus 5,结果做了一件让整个AI编程圈子都惊了的事——他们直接删掉了Claude Code里超过80%的系统提示词,然后发现,模型表现几乎没有变化。
这事的反直觉之处在哪呢?过去两年,所有AI编程工具的共识是:系统提示词越写越厚、越写越细,从行为规范到输出格式,恨不得把每条指令都塞进去。Claude Code的提示词以前也是这么堆出来的。但Opus 5发布后,团队发现,删掉80%之后,模型反而更聪明了一点。
Claude Code的创造者Boris Cherny在接受Y Combinator采访时解释了背后的逻辑。他的原话是:敢于按下删除键。每六个月,开发者应该把自己写的提示词全删了,看看新模型能做成什么样。先让它跑,观察它哪里做不好,再按需补指令,而不是一开始就提前预设一大堆限制。
Opus 5的进步不止体现在提示词精简上。它能连续自主运行数天甚至数周,不需要复杂的脚手架来辅助维持。提示注入攻击也基本失效了——基于神经元激活模式构建的分类器,让攻击无法复现。它在ARC-AGI 3评测上拿到了30%的分数,而此前最好的成绩还是个位数。
Boris Cherny对人和模型协作方式的理解也很有意思。他说,不要把模型当成一个需要精心调控的系统,而应该把它当成一个有生命的东西。用科学思维来对待:尝试、观察、基于结果迭代。顶级用户从来不会给模型写一篇小作文式的指令,而是给一个略具挑战性的任务,加上验证方法,然后放手让模型自己干。
他说了个很形象的词——「解除Claude的束缚」。两年前Sonnet 3.5已经能一次生成完整文件了,但当时的编程产品只支持单行补全和只读聊天,能力完全没释放出来。Claude Code的诞生就是为了「解除束缚」,给模型完整的终端权限。最新最极致的例子,Bun团队用11天,让模型把整个10万行Zig代码库重写成了Rust,代码已经在生产环境跑了。
这背后折射出的趋势比单个产品更新更重要。大模型正在以远超我们预期的速度变「聪明」,而很多产品设计和管理思路还停留在「得管着它」的阶段。 每六个月全删一遍提示词——这个建议看起来像是在调侃,但可能是今年AI工程领域最有价值的几条建议之一。