如果一位中国 AI 工程师技术精湛、履历光鲜,又出自北京大学这样的顶尖学府,那么他似乎无所不能,唯独不会选择“不上班”。刚因健康和生活是“最重要的对齐工作”从 Thinking Machines Lab 辞职的翁荔,很快传出重回 OpenAI 的消息。据公司发言人透露,她将领导一个加速内部研究的团队,参与 OpenAI 对“递归自我改进”的探索,即让 AI 参与训练并改进下一代模型。

同样引人注目的是,她的前同事、OpenAI 前核心人物 Ilya Sutskever 创办的 Safe Superintelligence (SSI),也终于向外界透露了一丝端倪。英伟达在罕见地获得内部研究访问后,决定向 SSI 投资,并利用新一代 Vera Rubin 系统将其算力提升一个数量级。英伟达确信 SSI 过去两年一直在推进一条不同于现有大模型的新路线。Ilya 未透露更多细节,仅表示:“我们有值得扩大规模的研究。”

好奇心驱使下,社交媒体上出现了一篇基于公开线索的分析文章,推测 SSI 寻找的并非下一套更大的预训练配方,而是一种新的迭代和进化方式:让模型不仅训练完成后静止不动,而是在反馈、实验和持续学习中不断产生更强的下一代。虽然这一判断未获 SSI 确认,但与 Ilya 过去的主张高度一致。他多次表示,单纯依靠更多数据和算力的 scaling 时代已近边界,AI 需要像人一样,用较少经验形成深度理解,并在与环境的互动中持续成长。

这些功成名就的 AI 头部人才似乎都将目光投向同一个方向:如何让 AI 替自己研发下一代 AI。

**“自我进化”并非 AI 半夜重写大脑**

提到递归自我改进,很容易联想到科幻场景:AI 意识到缺陷,直接修改权重,醒来后变得聪明十倍。但现实要朴素得多。AI 研发本就是循环流水线:研究员读论文、提假设、改代码、排队跑实验、看结果、找原因、再设计方案。如今的大模型已能参与许多环节:阅读代码库、复现论文、写脚本、调用算力、整理结果、分析参数。过去团队几天一轮的工作,未来可能由多个智能体并行尝试几十条路线,再把结果交给人类判断。

翁荔 7 月初的长文《Harness Engineering for Self-Improvement》几乎预言了她即将负责的方向。她认为,近期最现实的自我改进路径不是模型直接重写大脑,而是让 AI 先学会改造工作环境:自动分析失败记录,调整上下文管理、工具调用和工作流,再通过新结果优化系统。更成熟的 harness 推动自动化研究,更强的模型反过来简化 harness,形成循环。

这让翁荔与 Ilya 的路线产生有趣的呼应:OpenAI 更像是在把现有流程交给 AI,让其成为研究工程师;SSI 则可能试图从底层寻找新范式,让模型本身具备持续迭代能力。AI 不必一开始就能改权重,只要能优化训练流程、筛选数据、设计评测或优化 harness,就是在制造继任者。前者从工程循环往里走,后者从模型机制往外走,目标都是缩短一代 AI 到下一代 AI 之间的距离。

**同时,千人联名请愿放慢速度**

就在领军人物加速押注这条路线时,行业内部出现了另一种声音。本周,超 1100 名来自 OpenAI、Anthropic、Google、Meta 等公司的从业者联署声明,要求提前建立控制“自动化 AI 研发”速度的工具。参与者包括 OpenAI 首席科学家 Jakub Pachocki、Anthropic 联合创始人 Jack Clark 和 Jared Kaplan 等高级研究者——以及 Ilya 本人。

请愿并未要求停止研究,也未否认自我改进的价值,而是担心一旦 AI 显著加快研发,能力增长可能快过人类理解和控制系统的速度。仔细想想,这种看似矛盾的态度源于同一群人。同一时间,他们既相信自动化研究是关键,也相信必须拥有减速能力。因为循环一旦形成,就不同于过去发布更强模型。过去速度受制于人类团队(提出问题、安排实验、判断结果、受限于预算人力)。自动化研发的目标正是拿掉这些瓶颈。

**要进步,也要控制速度**

因此,看似矛盾的两股力量其实共享前提:自动化 AI 研发正从设想变为工程目标。翁荔回 OpenAI 说明递归自我改进已有负责人;英伟达投资 SSI 说明新路线值得验证。请愿者要求准备刹车,正是因为开始认真考虑成功后的后果。

真正的分歧不在于 AI 是否应辅助研究(代码生成、实验自动化已存在),而在于当 AI 从工具变成能自行提出方案、运行实验、评价结果并修改流程的系统时,人类应在何节点保留决定权。这意味着一系列问题:谁来设定目标?谁判断修改是否破坏安全边界?在竞争中谁愿暂停迭代?如果研发周期从一年缩到数周,外部评估和安全团队能跟上吗?AI 公司争夺的不仅是爆款模型,更是持续制造更强模型的研发系统。一边是 Ilya 和翁荔希望找到新迭代方式,另一边是上千名研究者要求准备减速机制。两种立场随时变化,但所有人都面对同一难题:当研究工具加速研究本身,谁还能决定下一代 AI 何时到来?

最新快讯

2026年07月31日

12:23
鼓狮财经7月31日电,安徽省人民政府办公厅印发 《安徽省加快数智供应链发展行动方案 (2026—2028年)》,其中指出,推动批发业数智化集成。支持大宗商品、农产品、消费品等领域批发企业建设数智化平台,引导大型农产品批发市场及其他专业市场积极发展电子统一结算,整合商流、物流、资金流、信息流,构建集成开放的供应链服务体系,为上下游客户和产业集群提供原料采购、仓...
12:23
鼓狮财经7月31日电,安徽省人民政府办公厅印发 《安徽省加快数智供应链发展行动方案 (2026—2028年)》,围绕构建“1188”现代化产业体系,聚焦先进制造业产业集群培育,发展现代服务业,推动数智技术与供应链全链条深度融合。到2028年,培育50家左右省级数智供应链领军企业、2—3家国家级数智供应链领军企业,打造15个以上省级数智供应链平台、2—3家在国...
12:11
首个模型Inkling亮相之后,全新AI又刷屏了! 今天,Thinking Machines正式发布第二款重磅模型——Inkling-Small。 276B总参数、12B激活参数,原生多模态,100万token上下文 半个月前,首个开源975B Inkling登场,曾在AI圈掀起了巨浪。 Inkling-Small仅用四分...
12:11
亚马逊昨日发布了第二季度财报。尽管数据繁杂,但净利润达到626亿美元,远超华尔街预期。然而,透过表象看本质,财报中隐藏着明显的“猫腻”。其中534亿美元净利润源于投资收益,而非实际经营现金流。真正反映亚马逊造血能力的,是275亿美元的营业利润。这种“左手当房东,右手握期权”的模式,让经营利润增速与净利润增速出现了巨大的背离。 为何亚马逊股价在盘后逆势大涨超9...
12:11
过去一周,最受瞩目的话题之一,莫过于两位中国籍数学家邓煜和王虹荣获菲尔茨奖。巧合的是,这两位科学家的“次元壁”也被意外打破:王虹的社交头像使用了动画《跃动青春》中的岩仓美津未,邓煜则挂着《天才麻将少女》的角色。网友们翻遍了两人的过往,发现他们也是不折不扣的二次元爱好者。而今天的主角,正是二次元圈里的一位技术大佬——米哈游创始人蔡浩宇。 从少年时期凭借计算机动...
12:11
前不久,Claude Code 的高频用户 Garry Tan 在探讨如何利用 AI 编程智能体时,提出了一个极具传播力的观点:一个 Skill 文件犹如一名员工,而公司真正需要构建的,是一套由知识库、记忆机制和图书管理员组成的大脑。尽管模型本身足够聪明,但若想让它长期理解特定公司的业务流程与偏好,仍需不断补充 Skills,为其打造一个可反复调用的“头脑”...
12:11
日本央行宣布维持1%的目标利率不变,这一决定符合市场预期。此前该行已将基准利率上调至1995年以来的最高水平。值得注意的是,审议委员高田创对此持异议,主张加息25个基点。他认为当前经济形势已进入新阶段,央行需采取更灵活的策略,以应对物价上行风险及海外金融环境的变化。 日本央行同时表示,将继续根据经济、物价走势及金融状况逐步提高利率。目前基础通胀已接近2%,金...
12:11
7月30日,苹果公司正式发布2026财年第三季度(截至6月27日)财报。这份被外界视为库克告别演出的成绩单,虽整体亮眼,却暗藏隐忧。财报显示,苹果当季总营收达到1094.17亿美元,同比增长16%,创下公司历史上6月季度最高纪录;净利润为297.89亿美元,同比大增27%。然而,服务业务营收307.4亿美元,略低于预期的312.2亿美元;大中华区营收188亿...
11:52
在今日的发布会上,中国贸促会代表中国工商界,就欧盟加快出台《网络安全法》修订草案及《工业加速器法案》一事作出正式回应。针对前者拟在信息通信、能源、交通等18个关键行业全面排除“高风险供应商”,以及后者对外国企业投资和参与公共采购设置诸多限制的条款,中国工商界表达了深切关切。 业界认为,相关做法明显超出了维护安全的必要限度,与世贸组织基本规则、国际服务贸易承诺...
11:52
7月31日,国家发展改革委新闻发言人、政策研究室主任蒋毅在发布会上指出,将深入实施能源安全新战略,加速推进新型能源体系“十五五”规划及相关配套政策的落地见效,致力实现从“能源大国”向“能源强国”的历史性跨越。 蒋毅强调,始终要把能源安全置于首要位置,筑牢极端情形下的战略安全底线。在具体举措上,要强化煤炭的兜底保障功能,加大油气增储上产力度,提升能源进口的多元...