近期,关于 Claude Code 系统提示词是删减还是暗中增加,引发了广泛讨论。起初,Claude Code 团队成员 Thariq Shihipar 发文称,他们将提示词缩减了 80%,且内部评测表现未见明显下滑。这一说法看似打破常识,毕竟在设计智能体时,人们往往倾向于编写冗长的提示词,试图通过添加规则来纠正模型的每一次错误。
然而,两天后,Qoder 工程师陈成通过抓取实际请求发现,大幅精简主要发生在 Opus 4.8 版本,而非 Opus 5。Opus 4.7 的提示词约为 15225 字符,4.8 降至 4467 字符,而 Opus 5 又回升至 7694 字符,比 4.8 增长了 72%。两组数据看似相互矛盾,让人不禁怀疑 Anthropic 是在放烟雾弹,还是在进行新的炒作。
事实并非如此。这次删减的 80%,实际上是为了旧模型时代而存在的六条“最佳实践”。
首先,我们要厘清删除的是什么。Anthropic 团队在审查内部记录时发现,同一个请求中经常充斥着相互冲突的指令。例如,系统提示词要求“不要加注释”,Skills 却要求“补充文档”,用户又临时要求“解释逻辑”。虽然 Claude 能理解用户意图,但处理这些矛盾指令不仅浪费时间,还消耗大量 Token。这些规则并非无用,而是旧模型缺乏判断力,必须写死规则以防乱删文件。但新模型已具备结合上下文自行判断的能力,旧规则已不再适配。因此,删除的内容主要集中在六个方向,旨在销毁那些“为旧模型准备的东西”。
第一,让模型自行判断。旧版规定默认不加注释、禁止多段文档字符串,新版仅保留一句话:匹配周围代码的注释密度与风格。规则看似减少,实则要求模型根据任务自主决定,判断量反而增加。
第二,设计接口而非提供事例。过去常将工具调用范例塞入提示词,但新模型容易将示例视为唯一答案。现在 Anthropic 侧重设计接口,如规定 Todo 工具的状态机,模型便能自行推断用法。
第三,按需加载而非一次性全加载。过去大量审查流程常驻提示词,新版将其拆分为独立 Skills,通过 ToolSearch 按需加载。模型只需知道资源在哪,用时再取。
第四,消除重复。旧模型易忘,规则常在系统提示词、工具描述和示例中反复出现。新模型长上下文理解能力更强,重复提醒反而易引发冲突。同一件事,只需在一个地方负责。
第五,交给模型自动记忆。过去项目说明和用户偏好堆砌在 CLAUDE.md 中。现在长期状态由自动记忆管理,CLAUDE.md 仅保留代码库简介和反常识的坑。“写出高质量代码”无需提醒,“类型必须放在同一文件”才值得记录。
第六,提供简单规格而非翻译说明。新模型无需人类将所有要求翻译成“适合 AI 阅读”的简化版。HTML 原型、测试用例和评分标准本身就是最佳参考,一张真实原型图远比模糊的形容词更有价值。
可以说,Anthropic 删除的不是上下文,而是人类替旧模型预先做出的判断。模型能力未增长时,规则是用来填坑;模型能力增长后,不肯删掉的规则反而成了坑。
既然旧规则失效,提示词为何没有一直变短?因为模型升级后,新行为开始影响体验,Anthropic 必须增加新的限制。这也是 Opus 5 比 4.8 多出 72% 的原因。
根据 Qoder 工程师陈成的推文及 Piebald-AI Claude Code 提示词库,Opus 5 主要增加了两段内容:Delivering work 和 Corrections。
Delivering work 要求 Claude 按照用户原本要求的范围交付工作。对于模糊问题,模型应自行判断;只有当不同理解会明显改变结果时,才需询问。此外,Claude 不能擅自扩大或缩小任务范围,不能只完成易做部分便声称完成,若某部分无法推进,也应先完成剩余部分并明确说明缺漏。这些规定旨在解决 Opus 5 自主性过强、容易“擅自行动”的问题。
Corrections 针对的是 Opus 5 过度解释纠错过程的行为。新版要求 Claude 只解释真正影响代码、结论或决策的错误,无关结果的小失误直接修改即可。不要加入道歉、开场说明或反复批评自己,也不要逐条统计错误。用户追问不等于模型一定犯错,若其他 Agent 指出问题,Claude 也需先判断对方是否正确,不能直接推翻自己。
一段是防止 Claude 做得太多,一段是防止 Claude 说得太多。旧模型首先要解决的是能否完成任务,而 Opus 5 已能完成复杂长任务,产品团队才开始处理任务范围和沟通过程的问题。
这背后蕴含着一个深刻的教训,即 Richard Sutton 所言的“苦涩的教训”。回顾 AI 发展史,人类总忍不住将自己的经验和解法硬编码进机器。下国际象棋就教套路,做语音就定音素结构,做图像就定特征。这些规则短期见效,但算力提升后,这些精心设计的规则迅速失效,反而是利用算力的通用方法最为有效。被淘汰的往往不是愚蠢设计,而是研究者最得意的部分。
Claude Code 删除的提示词,就是一个缩小版的“苦涩的教训”。正是这些提示词让 Claude Code 成为神级 Agent,但随着模型进化,它们反而拖了后腿。作为 Agent 与模型协同进化的领先者,Anthropic 通过这次删减风波,展示了如何应对模型变化带来的挑战。正如上次 Claude Code 源代码泄露推动了各类 Agent 产品的爆发,这次提示词删减背后所展示的“苦涩的教训”同样价值千金。
所有关注上下文工程的人应记住:不要把自己干活的每一步都写进提示词,让模型永远踩着旧经验的脚印走。更能扛过模型换代、持续扩展的,是一套能持续扩展的环境:具体走哪条路,最终应交给模型自己。
