你还在ChatGPT的聊天框里反复调试提示词吗?最近,一位X用户发布了一条推文,开头就是一个惊叹:头部大厂正在秘密使用的Claude Code项目模板外泄了!这不再仅仅是写提示词的问题,而是AI工程基础设施。整个体系围绕一个文件“CLAUDE.md”展开,而它的核心原则只有三条:每次Claude犯错,就加一条规则;每次你重复自己,就加一个工作流;每次出bug,就加一道护栏。这样做,是要把项目经验沉淀成它每次启动都会读取的长期上下文和自动化约束。整个架构,像是一家AI公司的岗位编制:CLAUDE.md是入职手册,skills/是工作SOP,hooks/是合规部,docs/是公司章程,tools/是后勤组,src/才是真正出活的业务部门。你不再是在和AI聊天了,而是在构建一个了解你代码仓库的AI。最疯狂的部分是,你只需要配置一次,Claude就会自动审查代码,并按指令重构、强制执行架构规则、撰写发布说明、从技能中运行工作流、记住过去错误等。而且它会越用越聪明。大多数人,都是打开ChatGPT,写提示词,复制粘贴,反复;而在这套打法下,你只需要打开终端,跑一个skill代码已交付。这等于是在自己的代码库里养了一队AI同事。这条推文背后,传递的是这个时代正在悄悄翻篇的一个小信号,大多数人可能还没反应过来。

01、一张不算泄露的“泄露截图”,撕开一个真相
@ai_rohitt晒出来的这张截图,是Anthropic官方文档里公开推荐的Claude Code标准范式。CLAUDE.md是Claude Code在每次会话开始时自动读取的项目记忆文件。.claude/skills/和.claude/hooks/是官方支持的扩展机制。这些都是社区已经讨论了几个月的公开做法,并不是什么人偷出来的“内部模板”。但它之所以能让一些资深开发者主动转发,说明它得到了一些天天用Claude的开发者们的认同。其中相当一部分人,可能这两天才意识到原来它还能这么用。而硅谷顶级团队,已经把这件事跑成了生产线。
第一个例子,是OpenAI Frontier团队。OpenAI官方披露的Frontier团队实验中,一个从空repo起步的内部beta,在约5个月内由Codex生成了约100万行代码和约1500个PR;团队从3人扩展到7人,人工不直接写代码。带队的Ryan Lopopolo在后续访谈中进一步提到,这套工作流已经接近“0人工代码、0人工 review”的极限形态。他认为与其节省token,不如利用模型极高的并发能力和极低的成本来代替人类有限且昂贵的同步注意力。
第二个例子,是Stripe内部的自动化代码代理系统Minions。Stripe内部的Minions每周生成并推动超过1300个PR合并,这些代码从头到尾由AI生成,但仍经过人工review。这里还有一对数据:1.6% vs 98.4%,它来自Mohamed bin Zayed AI大学VILA-Lab发表的一篇论文。研究者系统性扒了Claude Code v2.1.88版本51.2万行TypeScript源码,给出的结论是:只有1.6%是AI决策逻辑,剩下的98.4%是确定性的工程基础设施。具体说就是权限网关、上下文管理、工具路由、错误恢复这四类。这组数字不是说模型只贡献1.6%的能力,而是说明Claude Code作为产品,大量复杂度不在模型本身,而在权限、上下文、工具路由、恢复机制等确定性工程基础设施上。@ai_rohitt那张图里的CLAUDE.md/skills/hooks结构,就是普通开发者也能搭一套的“入门版基建”,它和OpenAI、Stripe那套生产级架构是同一种范式,只是规模小得多。

02、CLAUDE.md暴露的秘密
过去3年,所有人都在问“GPT什么时候能更聪明”“Claude什么时候出新版本”。但真正在生产环境跑通AI编程的团队,他们更关心的可能根本不是这个,而是如何让AI记住自己上次踩过的坑,怎么让AI在动手前先看一眼项目的架构约束,怎么让AI犯错的时候自己被工具挡住。CLAUDE.md正是这一切的承载体。Anthropic官方对它的定义只有一句:一个markdown文件,放在项目根目录,Claude Code在每次会话开始时自动读取。听上去很简单,围绕它展开的那几层结构,才是它真正厉害的部分。
CLAUDE.md是项目大脑。架构决策、命名约定、测试要求、那些反复踩过的坑,都堆在这里。它是AI每次启动时第一眼看到的“员工手册”。
.claude/skills/是可复用工作流。Claude Code的创建者Boris Cherny在社区里反复强调一句话:“如果你每天做某件事超过一次,把它变成skill或command。”一个skill就是一段可执行的方法论。Code review、生成commit message、写发布说明,这些都不该是每天手敲提示词的活,应该是skill调一下就出结果。
.claude/hooks/是自动护栏。这是最关键的部分。它不依赖AI自己判断,由确定性代码在AI犯错之前就挡住它。这就是为什么敢让AI“无人监督”地跑,因为出错的边界由hooks卡死了。
docs/decisions/是架构决策记录。让AI不仅知道代码“是什么”,还知道代码“为什么是这样”。这一项最容易被忽略,但也是AI协作最大的杠杆点。
tools/和src/是执行层。这套架构真正值得注意的地方,不在于某个开发者搞出了一个漂亮目录,而是越来越多独立团队正在收敛到同一个方向:把模型放进一套由上下文、工具、权限、评估和反馈循环组成的harness里。
GitHub上已经能看到不少类似项目:rohitg00的awesome-claude-code-toolkit、diet103的claude-code-infrastructure-showcase、affaan-m的everything-claude-code,都在围绕agents、skills、hooks、rules、MCP configs等组件搭建Claude Code的工程化工作环境。这说明,真正成熟的AI编程工作流,不是只靠一个更强的模型,也不是只靠一条更长的prompt,而是把模型嵌入一套可复用、可约束、可恢复、可审计的工程系统里。至于具体目录结构,各家实现并不完全相同。

03、OpenAI实验室的极限实验
2026年2月11日,OpenAI官方博客发了一篇文章:《Harness engineering: leveraging Codex in an agent-first world》。Anthropic围绕这个概念重新调整了Claude Code的架构思路;Martin Fowler的网站把它凝练成一个公式:“Agent=Model+Harness。”Harness这个词来自马术。它指的是马的整套挽具,缰绳、马嚼子、马鞍、笼头。一匹马可以跑得很快很有力,但它自己不知道往哪儿走:整套挽具决定了它的方向。类比到AI编程:模型本身能力很强,但它不知道在你的代码库里该往哪儿走。Harness就是你为它造的方向盘+刹车+导航。
OpenAI Frontier团队那个“100万行0人工”的实验,本质就是把Harness做到极致。他们的关键工程实践包括以下几条。
层级架构强约束。从Types到Config到Repo到Service到Runtime到UI,依赖关系单向流动,由linter在CI层强制执行。Agent写出违反层级关系的代码?直接构建失败。linter错误信息本身是修复指令,这也是最反直觉的细节。普通项目的lint错误是“violation detected”,给人看的;OpenAI Frontier的lint错误是“use logger.info({event: ‘name’, …data}) instead of console.log”,给Agent看的、可以直接读懂并修复的指令。
文档作为单一事实来源。所有架构图、execution plans、设计规范都在仓库内部的docs/目录。Agent不需要任何外部知识库,一切就在repo里。
这套东西效果有多厉害?模型没有换,但LangChain调整了harness,包括系统提示、工具、中间件和推理模式,最终把Terminal Bench 2.0分数从52.8提到66.5。

04、你今天就能做的事,是为AI造一个项目大脑
问题回到普通开发者这里:如果范式已经转移,作为一个普通工程师,今天就能做点什么。
第一件事,在你最重要的项目根目录建一个CLAUDE.md。不需要完美,也不需要很长。写下你团队的架构规则、命名约定、测试要求、那些反复踩过的坑,10分钟能写完一个能用的版本。下次AI犯错的时候,先不要手动修,而是问自己一句:CLAUDE.md里缺了什么?
第二件事,把每天重复做的事改造成skill。这里要注意Boris Cherny的金句:“如果你每天做某件事超过一次,把它变成skill或command。”Code review、生成commit message、写发布说明、修一类重复的bug,这些都该是skill,不该是每天手敲提示词。
第三件事,在容易踩坑的地方加一个hook。Hook是98.4%里最有杠杆的那部分。它不依赖AI变聪明,它依赖确定性代码做强制检查。这是把人类工程师的判断力翻译成机器可读约束的过程。这件事的核心不在写代码,而在写规则。
Karpathy今年1月在推特上的那句被广泛转发的话:“我已经从80%手动写代码变成了80%交给Agent写。”未来五年,工程师的能力曲线正在从“我能写多少行代码”转向“我能为AI设计多严格的工作环境”。写代码的活儿正在被Agent接管。但设计那个让Agent能写出好代码的世界,还是人的工作。而且比以前更难、更重要、也更有意思。

最新快讯

2026年07月31日

17:21
世界纷纷扰扰,AI日新月异,苹果的“老本”依然厚厚的、香香的。北京时间7月31日凌晨,苹果发布截至6月27日的2026财年第三季度财报。公司营收1094.17亿美元,同比增长16%;每股收益2.02美元,同比增长29%,均超过华尔街预期。iPhone收入增长22%,Mac增长29%。大中华区也延续了此前的反弹,收入同比增长22%至188.1...
17:21
作者 | 谢芸子 黄绎达 编辑 | 张帆 开云的转型初见成效。 7月28日,法国开云集团Kering发布2026年上半年财报,实现营收72.2亿欧元,可比口径下同比增长1%。 更关键的信号藏在第二季度——单季营收36.52亿欧元,同比增长2%。在中东局势仍不明朗、全球消费进入下行周期的情况下,开云实现三年来的...
17:21
7月30日,中国互联网的AI牌桌上,两张底牌同时翻开,背后藏着同一个焦虑——AI烧了这么多钱,到底怎么收回来? 上午,字节跳动一封内部邮件,把做了十年的飞书"拆"了:产品团队并入豆包,销售和服务团队并入火山引擎。飞书CEO谢欣向豆包负责人赵祺汇报,独立BU时代正式终结。 同一天,腾讯WorkBuddy发布V5.3.5重大版本更新,...
17:21
引子北京时间2026年7月30日晚间,美元兑日元的汇率剧烈波动,如上图所示,USDJPY从163.741一度下挫至157.938,振幅高达3.67%。目前,USDJPY稳定在160.610附近。对于这一现象,投资者们已经见怪不怪了,不少人的第一反应是,日本财务省对日元汇率进行了干预。这是因为,日元实在是太弱了,刚创下了40年以来的低位,并且日本财务省也不是第...
17:21
昨日收报25.36港元的南方两倍做多海力士(7709.HK)在今早9时20分时的开盘价为29.16港元,高开14.99%,随后股价在9时30分开盘瞬间一度飙升306.15%,报103港元,交易软件显示以103港元成交了100股(1手),股价瞬间又快速恢复至正常水平。这笔以103港元成交100股(1手)的交易是两倍做多海力士开盘后的第三笔成交。针对此异常波动,...
17:21
在广州新济医药递表港交所的同一天,普祺医药也递交了招股书。鼓狮财经获悉,北京普祺医药科技股份有限公司(简称:普祺医药)于7月24日递表港交所,寻求以18A章规则在港股上市,由中信证券、民银资本担任保荐人。这是其继 2026 年1月首次递表失效后的第二次尝试。此前,普祺医药还曾寻求A股上市。2025年6月25日,普祺医药向北交所提交了上市申请,并于2025年1...
17:21
7月31日,财政部发布2026年1-6月全国国有及国有控股企业经济运行情况。1-6月,全国国有及国有控股企业(以下称国有企业)营业总收入同比下降2.0%,利润总额同比增长2.4%。一、营业总收入。1-6月,国有企业营业总收入402427.0亿元,同比下降2.0%。 二、利润总额。1-6月,国有企业利润总额22475.8亿元,同比增长2.4%。&nb...
17:21
上证指数收涨0.72%,创业板指涨3.06%。截至收盘,上证指数涨0.72%报3832.26点,深证成指涨2.21%报13578.93点,创业板指涨3.06%报3343.96点,三市成交额25598亿元,较上日放量2014亿元。全市场近4700只个股上涨。多模态AI概念股爆发,Kimi、ChatGPT、AIGC方向领涨;宇树机器人、CPO、存储器、算力租赁、...
17:17
鼓狮财经7月31日讯,香港特区政府统计处今日发布2026年第二季度本地生产总值(GDP)的预先估计数字。数据显示,香港二季度GDP较去年同期实际增长4.3%,虽较一季度的5.9%增速略有回落,但依然保持强劲扩张态势。特区政府发言人指出,这主要得益于对外贸易的繁荣以及内部需求的坚挺。展望下半年,香港经济预计将继续保持稳健增长。
17:16
鼓狮财经7月31日报道,韩国KOSPI指数周五收盘暴涨18%,不仅大幅扭转了此前三天的下跌颓势,更刷新了单日最大涨幅的历史纪录。根据LSEG的数据显示,历史上KOSPI指数十大单日涨幅中,有五次发生在今年三月以来;而在过去十年中,四大单日跌幅中有三次出现在最近五周内。 KB金融集团全球战略师彼得·S·金指出,股市的“游戏化”特征引发了剧烈震荡,这种波动主要受...
16:38
喜讯传来,OpenAI 刚刚宣布对 GPT-5.6 系列模型进行大幅调价。其中,GPT-5.6 Luna 的价格下调了 80%,输入价格降至每百万 Token 0.20 美元,输出价格降至每百万 Token 1.20 美元。GPT-5.6 Terra 的价格下调 20%,输入价格降至每百万 Token 2 美元,输出价格降至每百万 Token 12 美元。此...