这几天,围绕 Claude Code 系统提示词的删减与增补,业界争论不休。先是 Claude Code 团队成员 Thariq Shihipar 发文称,他们砍掉了 80% 以上的提示词,内部评测结果并未下滑。但这番言论很快遭遇了反转。两天后,Qoder 工程师陈成抓取了实际请求数据,指出大幅精简发生在 Opus 4.8 版本,而非 Opus 5。4.7 版本提示词约 15225 字符,4.8 降至 4467 字符,而 5.0 又增至 7694 字符,比 4.8 增长了 72%。两组数据看似打脸,实则揭示了 Anthropic 在模型迭代中的真实策略:并非单纯的删减,而是根据模型能力的进化,对提示词进行重构。

第一,删掉的 80% 是旧模型时代的最佳实践

首先需要明确,删掉的内容主要针对的是旧模型。Anthropic 团队在梳理内部使用记录时发现,旧提示词中充满了互相冲突的要求。例如,系统提示词规定“不要加注释”,技能配置却说“适当补充文档”,用户临时又要求“把复杂逻辑解释清楚”。旧模型必须先处理这些矛盾,效率极低。虽然这些规则能防止旧模型犯下乱删文件等致命错误,但在新模型具备足够判断力后,这些死板的规则反而成了累赘。

因此,这次删除主要沿着六个方向,销毁了那些为旧模型准备的“护栏”:

第一,注释策略。旧模型默认不写注释,禁止多段文档字符串,这能压制其表达欲,但也常误伤复杂代码。新版只保留一句话:匹配周围代码的注释密度、命名和习惯。看似要求少了,实则判断更难,需要模型根据任务自主决定。

第二,示例与接口。过去设计 Agent 时,常塞入大量工具调用范例。Anthropic 发现新模型容易把示例当成唯一答案,于是改为多设计接口。例如 Todo 工具只需定义 pending、in_progress 和 completed 状态,并限制同时只能有一个任务进行,模型便能自行推断用法。

第三,按需加载。过去大量审查、验证和工具说明常驻系统提示词,用户改一句文案也要陪模型跑长上下文。现在这些流程被拆成独立 Skills,工具定义通过 ToolSearch 按需加载。模型只需知道东西放在哪,用时再取。

第四,消除重复。旧模型容易忘指令,导致同一条规则在系统提示词、工具描述和示例中反复出现。新模型对长上下文理解更深,重复提醒反而容易制造冲突。同一件事,现在只交给一个地方负责。

第五,记忆管理。过去过去项目说明、用户偏好全往系统提示词里堆。现在长期状态交给自动记忆,CLAUDE.md 只保留代码库简介和真正反常识的坑。“写出高质量代码”不必提醒,“所有类型必须放在同一个文件里”才值得写。

第六,简化说明。旧模型需要人类把所有要求翻译成一份“适合 AI 阅读”的简化说明。新模型已无需如此,HTML 原型、测试用例、现有代码和评分标准,都可以直接成为参考。一张真实原型图告诉 Claude 的东西,远比“页面要高级、简洁、有呼吸感”更多。

可以说,Anthropic 删掉的不是上下文本身,而是人类替旧模型预先做好的判断。模型能力未增长时,规则是在填坑;模型能力增长后,不肯删掉的规则,本身就成了坑。

第二,增加的 70% 是管理新模型的坏脾气

删除旧规则不代表系统提示词会一直变短。模型升级后,一些过去不明显的行为开始影响体验,Anthropic 又不得不增加新的限制。Opus 5 比 4.8 长了 72%,正是为了管理新模型的“坏脾气”。

根据 Qoder 工程师陈成的推文,Opus 5 主要增加了两段内容:Delivering work(交付工作)和 Corrections(纠错规范)。

Delivering work 要求 Claude 按照用户原本要求的范围交付工作。普通模糊问题由模型自行判断,只有理解分歧会改变结果时才需询问。它严禁模型因为发现更好方案,就擅自缩小、扩大或改变任务,也不能只做容易的部分然后声称完成。若某部分无法推进,也需先完成剩余部分,再明确说明缺失原因。

Corrections 针对 Opus 5 容易过度解释的倾向。该模型喜欢向用户解释纠错过程,指出哪句话错了、原因是什么、准备怎么调整。这种行为在长任务中会显得反复啰嗦,且很多更正并不改变最终结果。因此,Corrections 要求模型只解释真正影响代码、结论或决策的错误。无关结果的小失误直接改掉继续做,不要加入道歉、开场说明或逐条统计错误。用户追问不等于 Claude 之前一定说错了,面对其他 Agent 的质疑,也要先判断对方是否正确,不能直接推翻结论。

一段是防止 Claude 做得太多,一段是防止 Claude 说得太多。旧模型首要任务是能不能完成任务,而 Opus 5 已能完成更复杂、更长的任务,产品团队才开始处理任务范围和过程沟通的问题。

第三,苦涩的教训:人类最舍不得删掉自己的聪明

2019 年,强化学习先驱 Richard Sutton 写了一篇名为《苦涩的教训》的文章。他回顾了七十年的 AI 发展史,发现人类总忍不住把自己的经验和解法直接写进机器。下国际象棋,就告诉机器人类棋手的套路;做语音,就把音素结构写死;做图像,就让专家指定视觉特征的重要性。短期看,这些规矩往往立竿见影,也让研究者最有成就感。但当算力上来,这些精心设计的规则很快失效,反而是利用算力的通用方法最有效。

这个教训之所以苦涩,是因为被淘汰的通常不是愚蠢设计,恰恰是研究者最得意、投入最多的部分。人类的智慧,在算力大砖飞面前,不值一提。

Claude Code 删掉的那些提示词,就是一个缩小版的“苦涩的教训”。正是这些提示词,让 Claude Code 成为神一样的 Agent。但随着模型继续进化,这些提示词开始反过来拖产品的后腿。作为 Agent 与模型协同进化领域最领先的产品,这一次的删减风波,难得地把 Claude Code 在设计系统提示词时如何应对模型变化背后的核心思想展示了出来。想想上次 Claude Code 源代码泄露给后续各类 Agent 产品爆发带来的关键作用,就知道这次看似提示词删减背后,这一整套“苦涩教训”的价值千金。

今天所有关注上下文工程的人们该记住的是,别把自己干活的每一步都写进提示词,让模型永远踩着旧经验的脚印走。更能扛过模型代际更替的,是一套能持续扩展的环境:具体走哪条路,最终应该交给模型自己。

最新快讯

2026年07月30日

10:45
最近这一个月,硅谷AI界可谓大招频出,GPT-5.6、fable5、Grok-4.5接连问世。一时间,国内开发者、程序员群体纷纷沸腾,各种关于GPT-5.6等前沿模型的讨论、测评此起彼伏。尽管这个月也有Kimi-K3这样的新锐国产模型问世,但总的来看,国产大模型当前在一线开发者群体中,始终处于一种“叫好不叫座”的状态。根据最新数据,在使用量...
10:45
北京时间7月29日,据《华尔街日报》报道,硅谷正在酝酿一股反Anthropic的风潮,其根源在于该公司推出的产品与现有软件提供商形成竞争,以及它对封闭式AI生态系统的倡导。 与合作伙伴竞争 创业公司创始人、软件公司高管及AI研究人员表示,在看到Anthropic向市场推出了一些与其他公司产品形成竞争的工具后,他们开始转向价格更低的AI模...
10:45
过去几天,一篇名为《王的猜想》的文章刷屏了。 它原本是《广西日报》为数学家王虹写的一篇人物特稿。文章火到纸质报纸一份难求,报社不得不宣布加印,就连价格都从 1 块钱炒到了二手平台上最高 60 块一份。 图片来自:广西日报微信公众号 7 月 23 日,35 岁的王虹获得菲尔兹奖。公众最熟悉的成果,是她与数学家 Joshua Za...
10:45
当代版 “ 焚书坑儒 ” 的判决出来了,但 “ 焚书坑儒 ” 成了里面最合法的一环。。。 从 2024 年 8 月,到这个月 20 号,拉扯了快两年的 Anthropic 盗版书训练集体诉讼案,终于结束了。法院最终批准,Anthropic 向原告支付15 亿美元的天价和解金。 这个数有多夸张呢,这么说吧,不看那些离谱的 ARR,根...
10:45
过去一年,OpenAI经历了一段Altman自己都承认“相当艰难”的时期。 在近期播客节目《Invest Like The Best》中,他少见地进行了系统性复盘,涵盖战略失误、竞争压力、安全隐患,以及他对AGI时间线和机器人未来的最新判断。 01 最艰难一年:“战线太宽,是我的错” "过去一年相当艰难,部分是我的错。"Altman...
10:44
7月29日盘后,Facebook母公司Meta Platforms交出了截至6月30日的2026年第二季度财报。具体来看,第二季度营收608亿美元,同比增长28%,创历史新高。但仅仅158亿的净利润,远远低于分析师预期的185-195亿;相比一季度267亿的净利润,更是几乎腰斩。自由现金流仅剩7.84亿美元,同比暴跌91%,创下了2022年三季度以来近四年最...
10:44
三星电子于7月30日发布了2026财年第二季度财报。公司二季度销售额171.50万亿韩元,同比增长130%;营业利润89.49万亿韩元,同比增长1814%,数据再次刷新历史纪录。与此同时,公司对2026年下半年展望积极,预计芯片供应短缺将在下半年持续。财报大超预期,叠加韩国政府出手稳市提振,三星电子今日拉涨超7%。Q2营业利润暴涨1814%数据显示,公司该季...
09:57
若要一句话概括当下漫剧圈爆火的“罪妻”模式,那便是:女主开局被发配边关,被迫选夫后,在艰苦环境中开启种田基建,凭借智慧与坚韧让荒地重获生机,并收获爱情与亲情。这一模板衍生出星际、兽世、废土等无数变体。而其源头,竟是两位“95后”夫妻自制出品的《发配边关,罪妻开荒养出战神》。该系列已更新至第九季,共有6部作品跻身“上半年AI剧/漫剧红果百强榜”TOP15。仅凭...
09:57
近期,关于 OpenAI 硬件生态版图的曝光速度显著加快。无论是彭博社关于音箱细节的报道,还是供应链分析师郭明錤关于手机规格和代工订单的详细调查,都让我们逐渐拼凑出了这头大象的实际轮廓:一台音箱、一部手机,后续可能还有眼镜、台灯,甚至耳机。 其中,音箱作为最早推出的硬件产品,预计将于 2027 年初上市,定价在 200 到 300 美元之间。OpenAI 交...
09:57
最近这一个月,硅谷 AI 领域可谓动作频频,GPT-5.6、Fable 5、Grok-4.5 等顶尖模型相继发布,瞬间点燃了国内开发者与程序员的热情,关于这些前沿模型的讨论与测评层出不穷。虽然 Kimi-K3 等国产新锐模型也在同期问世,但从整体趋势来看,国产大模型在一线开发者群体中,依然面临着“叫好不叫座”的尴尬局面。 根据 OpenRouter 的数据,...
09:57
影视飓风似乎正在取代李一舟,成为新一代“AI教父”。近期,影视飓风推出了一门AI实战课,迅速卖爆。该课程共16课时、五个单元,内容涵盖AI生图、视频生成、提示词教程、TapNow功能介绍,以及首尾帧、全能参考等高阶玩法。每节课时长5至17分钟。原价99元,券后优惠价49元。上线当天,销量即突破10万单,日入近500万元。半个月后,该课程在抖音、B站、视频号等...
09:57
7月30日,字节跳动启动面向AI业务的组织架构调整,旨在强化豆包、飞书与火山引擎在企业生产力场景下的协同合作。 在产品研发层面,飞书与豆包的产品团队将合并,组建全新的“豆包产品团队”。该团队由赵祺(原豆包负责人)领导,飞书负责人谢欣将向其汇报。在市场与销售体系方面,飞书GTM团队将与火山引擎团队整合,成立新的“创造力服务平台”。该部门由谭待(原火山引擎负责人...