最近两周,因为Claude Fable 5回归、GPT-5.6上线再加上Tibo义父疯狂的重置。

以及AIHOT月活用户,最近也正式突破了50万。

所以导致,我现在每天Vibe Coding的时间,几乎惊人的达到了16个小时。

我现在每天Vibe Coding到早上6、7点,然后睡一觉到中午12点起床收菜,然后去公司,路上用UU远程+Codex继续Coding。

我几乎不会让AI闲着,他们闲着的每一秒,我用不完的每一个token,都感觉是对Tibo义父的不尊重。

每天真的就是不眠不休,感觉自己染上了Coding的瘾,主要还是创造和学习知识的快感,实在是太爽了。

昨天回复一个人的评论我还是这么回复的:

       

那种爽感我一直不知道怎么描述。

直到前天打车去机场,时间感觉要赶不上的时候,我跟司机说,求求你快点,然后司机一脚油门,那一瞬间我知道该怎么形容这种爽感了。

这是一种属于时代的推背感。

它在不断推着你向前、向前、再向前。

而因为Claude Fable 5和GPT-5.6 Sol在智力和执行上的飞跃,我跟Agent协同开发的流程相比于Opus 4.8时代,也有了比较大的转变。

前期我把巨量的Token都消耗在了一个地方,那就是优化我的整体测试流程上。

在Vibe Coding中,开发的流程已经被大幅加速,写代码已经不再是瓶颈了,瓶颈专业到了测试、验证,还有你对方案的评审上。

测试覆盖率目前做到了还算是比较舒服的区间。

然后因为现在高频提交、Agent自动开PR、反复跑测试的开发方式,为了节省测试和部署的时间,我甚至单独去腾讯云上搞了一台便宜的服务器来做CI,没用GitHub的托管Runner了,然后做了很多任务类型的路由来保证测试全面性和准确性的情况下,节省整体的时间。

哦对了,这里可以提一句,其实Vibe Coding到后面,当你项目越来越大的时候,像Codex的所谓的1.5倍快速模式有的时候并不快,开着没啥意义。

因为大量的时间都是消耗在了确定性测试流程上,Agent提测,测试要大概5分钟时间,然后被测试打回,修复,继续提测,又是5分钟。

整体缩短的时间其实相当有限。

整体测试流程优化的差不多了之后,你会发现,你的想法,终于可以肆意的挥洒了,因为,你大概率无需担心实现不了或者出现BUG,只要你能提出来,那大概率能稳定且完 美的实现。

那最 大的难点就来了,前期如何设计你的方案,如何自动化的交给Agent进行开发,同时省心省力,上线的效果还有保障。

这两周跟这两顶 级模型协同下来,我觉得最 好的流程,就是Claude Fable 5做研究出方案初版,GPT-5.6 Sol来纠错和优化,然后在Codex中开起目标模式全自动化执行,之后,你就可以放手去睡觉,等着起床收菜就行了。

就是这么简单。

大道至简,重剑无锋,你根本不需要什么奇奇怪怪的技巧,直接说话就行。

举个新鲜的例子。

还是我的AIHOT。

最近在史诗级强化了防御、优化了Agent接入机制、上线了UI 2.0、解决了用户收不到Skill更新通知的问题、大幅重置了详情页、更新了精选算法、优化了聚簇的算法、还有一堆更新之后,我又想把之前一直想做的一个新功能给大幅重构和加强了。

就是全网AI热点,也就是现在当前热点那个位置。

判断什么东西很热是一个很有意思的话题,我对它的理解特别简单,就两个指标:

有多少人正在讨论它,它的数据趋势怎么样。

这两者合并,基本就能看出一个事件的热点程度了,如果一个事件,讨论的人越来越多,总数据越来越大,那基本就可以看出来这是一个正在大幅增长的热点。

如果人数越来越多,但是数据增长趋势一般,从而两者形成了剪刀差,那可能就是营销投放或者别的原因。

如果人数不咋多,但是数据一直在大涨,那可能就是平台推荐算法的随机漫步,或者是跟具体的人相关,而不足以成为破圈性的热点。

所以,我想用这个机制,来做一个功能,去抓取整个互联网,可能上万个以上的信源,来去找到并监控AI行业,真正正在爆发的热点。

现在AIHOT上的当前热点其实做的非常的粗糙,就是看看目前监控的200多个信源有多少人正在讨论,在24小时这个生命周期的衰退里,这个数字是多少,然后排个大小。

但是要升级成真正的全网AI热点,那肯定不能这么干的,肯定要解决我刚才提到的两点里面的第 一点,要监控更多的账号,甚至可能是上万个账号。

而且这些账号,整体是要跟精选体系里监控的账号分开的,这上万个账号,只贡献热度,但是不会被精选,在我的体系里,一般称为热点信源。

大概就这个目标,然后,我就把这一通需求,第 一步,先发送给了Claude Fable 5,让它给我出一个方案。

我发过去的字就不用干了,直接豆包语音输入法瞎BB的,非常乱,但是大概的意思表达清楚了就差不多了。

你相信我,在如今这个时代,Claude Fable 5在做方案的初版设计上,在先进程度和优雅程度上,就是当世独一档,越是大型的方案越能体现出它的智力程度。

在大概20分钟之后,这个方案出来了。

但是注意,这个方案是不能直接用的,这也是为什么我说Claude Fable 5的方案只能是初版的原因,因为Claude家族一向的特性,就是丢东西,不细致也不细心。

所以接下来是第二步,把我们的需求和Claude Fable 5的方案,直接复制粘贴给Codex,选中模型为GPT-5.6 Sol极高。

然后说,这是隔壁同事做的,你详细审查一下。

GPT-5.6 Sol经常能挑出Claude Fable 5方案的问题,而且是比较严重的问题。

比如这一次,它花了6分钟,找到了个原有方案里非常关键的隔离问题,甚至会影响我们其他的流程管线和架构。

最后问了我一个问题。

回答完以后,它就给了我最终的方案。

然后,接下来的第三步,就更加简单了。

在Codex中,你点击左下角的加号,会发现有一个模式,叫目标模式。

选中它。

你就会发现你的输入框下面出现了一个东西叫目标,这就说明,你进入目标模式了。

这个目标模式的意思特别简单,就是Codex会一直跑一直跑,不达到你的目标不罢休。

我自己最长的目标,就是前天,跑过17个小时的,从早上6点睡觉之前挂机,一直跑到第二天凌晨才跑完,直接给我额度一天清空了。

我当时还发了个X,纪念一下这个成就的达成。

然后这一次,我也设定了一下目标,这个目标简单到有一点不可思议,其实就一句话:

“根据上面所述的方案进行开发,保证没有任何错误,然后合并部署上线。”

我敢这么做的原因,是因为我对我自己的测试流程还是有自信的,确实还是比较严格,所以如果有一些BUG其实大概率都是过不了会被打回来的重新优化的。

而且因为这个方案其实比较大一点,要做的东西比较多,细节更是多,跟各个模块都有部分耦合,所以目标模式,是执行起来效果几乎是最 好的。

当然,如果只是个小任务,你就别用目标模式了,直接让GPT-5.6 Sol去按流程去执行完毕就可以了。

而且有一说一,Codex的目标模式,做的真的比Claude Code的效果要好,可能是因为GPT系列一直以来幻觉率极低,Prompt遵从效果也好,所以超长程任务几乎都不会变形,Claude推着推着有时候就不知道干个什么鬼东西了,甚至还会陷入死循环。

除非你是土豪,壕上天际,要不然你总不能拿Fable 5开目标模式吧。。。

目标定完发给Codex之后,其实你就可以去睡觉了,交给他自己在那开发了。

截止到我写文章,目前已经跑了2个半小时,我也不知道它还要跑多久。

但是大概率没啥问题的,因为想要合并部署上线,还有一堆的流程要走。

我自己现在的全流程大概是这样的:

我发任务后
→ Agent理解并核实问题
→ 新建独立分支和工作区
→ 开发修改
→ 自动测试,必要时回测或检查页面
→ 推送分支并创建PR
→ CI自动验收
→ 合并到主分支
→ 部署上线
→ 检查真实线上效果
→ 使用洁癖.skill同步代码、文档和Agent记忆,并复盘经验
→ 向我汇报最终结果
→ 等我确认没有问题
→ 清理开发分支、工作区和临时数据库
→ 任务结束

所以基本上一个任务过去以后,它就会自己走完所有的流程,保证没啥效果,然后部署上线,最后等我确认这个完成效果行不行,是不是要清理掉分支啥的。

我现在基本就是常年好几个任务并行。

我自己感觉6~7个任务并行几乎就是我注意力的极限了,我曾经尝试过更多,但是那时候,我感觉就是我自己人脑确认不过来了。。。

我自己,就是Agent最 大的那个瓶颈。

所以在如今模型能力如此进步的今天,绝大多数的什么开发skill比如superpowers这种都已经没啥大用了,相信我,绝 对不如我现在这套流程来的效果好。

核心其实就是个哑铃形状。

在左边是用最牛逼的模型出方案、优化方案,然后执行。

最右边,就是你的最重要的测试和研究流程,还有用我的洁癖.skill保证文档、规则、记忆、代码四端统一。

当你完成了这套流程的搭建之后。

相信我,你绝壁会体验到Vibe Coding的爽感的。

那是一种,广阔无垠的创造力。

那是一种,自由探索未知的奇妙。

那是一种,来自AI时代的疯狂推背感。

去创造吧。

最新快讯

2026年08月29日

15:01
鼓狮财经8月29日电,据美国“动力”网站“战区”频道8月28日报道,美军正计划对位于西班牙的莫龙空军基地进行改造,包括新建停机坪,以容纳额外9架绰号“同温层堡垒”的B-52战略轰炸机。此外,五角大楼正重新审视其在欧洲的军事部署,其中可能包括重大基地调整。报道称,此次改造属于美国在西班牙罗塔地区一项近5亿美元设施建设项目的组成部分,这些设施为美国在欧洲、非洲和...
15:00
工程机械行业正步入新一轮增长周期。随着国内上一轮高峰投放的设备陆续进入更新窗口期,叠加政策刺激,替换需求持续释放。与此同时,海外市场持续扩容,中国企业凭借供应链优势、智能制造能力及新能源技术,正加速抢占全球市场份额。矿山装备、机器人等新兴领域也不断开辟新的增量空间,使得行业增长不再单纯依赖地产或基建周期,全球化与多元化成为新的增长引擎。中联重科便是这一趋势下...
14:28
鼓狮财经8月29日讯 OpenAI首席执行官萨姆·阿尔特曼与埃隆·马斯克之间的矛盾再次激化。美东时间周五,OpenAI宣布将停止向代码工具Cursor提供AI模型服务,而Cursor目前隶属于马斯克旗下的SpaceX。 这一决定发生在SpaceX于6月宣布以600亿美元全股票交易收购Cursor母公司Anysphere,并于本月初完成收购之后。OpenAI随...
14:28
8月29日,长鑫存储宣布新一代LPDDR6内存正式量产,并首发搭载于小米18Fold旗舰折叠屏手机。对此,雷军在微博发文盛赞:“祝贺长鑫实现LPDDR6内存量产,非常了不起!玄戒O3是首款支持长鑫LPDDR6的芯片,小米18Fold也首发搭载了该内存。我相信这只是开始,未来会有更多优秀的中国科技企业强强联合,勇攀高峰!” 值得注意的是,就在本周,小米集团也宣...
14:28
今年财政节奏明显放缓。这一现象主要体现为支出进度缓慢和发债进度滞后。 首先,财政支出增速远低于收入增速。今年前7个月,财政支出同比增长1.3%,而同期财政收入增长5.8%,导致财政赤字仅为1.9万亿元,显著低于去年同期的2.5万亿元,赤字落地进度明显慢于往年。其次,专项债发行进度显著低于往年。截至本周,2026年新增专项债累计发行2.88万亿元,发行进度为6...
13:58
鼓狮财经8月29日讯,山西焦煤在业绩说明会上透露,近期公司主要涉及的停产矿井包括西曲矿、马兰矿、镇城底矿及西铭矿。 在具体停复产时间上,西曲矿经历了多次波动:该矿于7月23日停产,7月30日复产,8月5日再次因事故停产,直至8月26日才恢复生产。马兰矿于7月27日停产,随后在7月30日恢复生产。至于镇城底矿和西铭矿,则分别于7月27日和7月30日停产,此次停...
13:26
每一轮产业革命,都会重写资本的流向,也会重排金融机构的座次。2026年的全球资本市场,处在两股力量的拉扯中:股债震荡与宏观不确定性压制风险偏好,AI、具身智能、半导体和先进制造却继续催生融资、并购与产业整合需求。资本并未离场,只是变得更加挑剔:既要看懂技术浪潮,也要找到能够把产业机会转化为真实交易和持续回报的平台。这恰恰是华兴资本重新显露锋芒的时刻的到来。凭...
13:26
近日,英伟达Spectrum-X Ethernet Photonics CPO交换芯片宣布全面量产,首批产品交付CoreWeave、Lambda Labs与甲骨文,成为全球首款实现规模化商用的200G/lane CPO交换机系统。这一节点的意义远不止一款产品落地,它标志着CPO(共封装光学)正式走出实验室,从行业远期路线图变成了AI数据中心的现实选型。几乎同...
12:22
鼓狮财经8月29日电,据媒体报道,空客正探索出售旗下美国航天业务,同时计划通过三方合并,打造一家泛欧洲卫星龙头企业。知情人士透露,空客正在评估潜在收购方对其美国航天业务的收购意向。空客美国航天系统业务包含佛罗里达州一处工厂,以及“箭”系列小型卫星。该系列卫星可实现规模化量产,面向商业及政府通信、对地成像业务,也可满足国家安全相关需求。针对“市场传闻与猜测”,...
12:22
鼓狮财经8月29日电,美国《国会山报》网站8月28日刊文指出,在此前的贸易谈判中,美国政府希望加拿大完成F‑35战机采购,并采购美国雷达飞机,以此加入特朗普总统的“金穹”导弹防御项目,并给予美国对加拿大关键矿产的优先购买权。随着谈判破裂后加拿大宣布实施反制措施,对美国而言,更大的损失或许要在关税问题不再成为头条新闻之后才会显现。文章指出,早在本次谈判破裂之前...
12:21
美日两国联手干预汇市不到一个月,日元汇率再次逼近160心理关口。周五,美联储主席沃什表态将全力达成通胀目标,美元走强,日元延续跌势。市场分析指出,随着日元触及160这一关键点位,干预预期正不断升温。 针对上月的美日联合干预行动,美国财政部长贝森特近日罕见地进行了公开辩护。虽然干预后美元兑日元一度从四十年高位163跌至155下方,但好景不长,进入8月中旬后日元...
11:48
据鼓狮财经8月29日报道,近期日本高市内阁的支持率持续下滑。日本《每日新闻》的最新民调数据显示,高市内阁的支持率已跌至41%,创下其执政以来的最低纪录。对此,日本政治经济学家滨田和幸分析指出,当前民众对经济前景的忧虑日益加剧,而高市内阁却未能采取有效措施,这种不满情绪恐将对其支持率造成进一步冲击。