今天,外媒The Information爆料称,OpenAI内部的AI模型已经实现了“自我训练”。具体而言,这些内部模型已经接管了实验性AI模型的训练全流程,开始自主“打造”自己。研究员只需提供优化示例,AI就能自行运行数周,多智能体自发协作,互相讨论并迭代代码,完全无需人类介入。更令人震惊的是,原本需要数年才能完成的宏大实验,如今已被压缩至短短一周。随着这一重磅消息的传出,OpenAI紧急发布了一份全球安全倡议,直指AI领域最敏感的核心——递归自我改进(RSI)。他们大声疾呼:在AI失控之前,全球必须联手给它套上“紧箍咒”。
01 AI学会“手搓”GPU内核
在顶尖AI实验室,训练大模型曾是一项极其繁琐的工程。其中成本最高、技术最复杂的环节,莫过于针对底层图形处理器编写GPU内核代码并进行逐行优化。这曾需要全球最顶尖、年薪数百万美元的高级算法工程师们通宵达旦地“手搓”完成。然而,据The Information最新披露,如今在OpenAI内部,这些核心工作已大部分被AI接手。OpenAI内部的模型如今能够自行编写在GPU内核上运行或训练模型所需的程序,并生成相应的优化方案。工程师只需提供一个优化示例,AI就能持续运行数周来落实优化。得益于模型能力的提升,这种AI驱动的自动化水平直到最近几个月才成为可能。甚至,员工的智能体之间还能相互协作解决问题,无需惊动人类。这,便是递归自我改进(RSI)的雏形。
02 OpenAI紧急吹哨:RSI真来了,人类正在失去控制权?
试想,如果你制造了一个智商100的机器人,任务是“造出比自己更聪明的机器人”。于是,它造出了智商120的二代;二代利用120的智商造出了150的三代;三代接着造出了200的四代……一旦跨过某个临界点,AI的进化速度将呈垂直向上的折线,瞬间将人类甩在几万光年之外。以前,人们认为这还很遥远,但现在,OpenAI自己也感到了恐惧。就在今天,OpenAI官方紧急发布了一份重磅全球安全倡议。报告罕见地将“RSI”单列一节,明确指出“全自主RSI今天并未发生,在能安全做到之前不应推进”,并呼吁各国AI安全研究所网络制定全球技术标准。OpenAI在报告中直言警告:“随着AI系统在开发下一代AI的工作中承担越来越多的任务,它们可以日益推动RSI的进程。随着这一过程变得更加自动化,AI进步的步伐可能会急剧加速。”虽然完全自主的RSI今天尚未实现,但时间已非常紧迫。报告指出了当前的首要任务:“驾驭下一阶段的AI进展,构建自动化的AI研究员,并找到让人类留在自我改进循环中的方法。”请注意后半句话——“让人类留在循环中”。这正是他们最大的担忧:人类可能很快就会被踢出局!OpenAI骄傲地提到,AI驱动的研究已推动数学领域的重大进步,如攻克千禧年难题。但硬币的另一面是无尽的深渊。报告写道:“随着过程变得更加自动化,AI进展的步伐可能会迅速加快……如果不采取适当的谨慎措施,RSI可能导致人类失去对AI发展的实际控制,无法对他们不再理解的研究过程提供监督。”这就是所谓的“黑盒效应”。当AI代码由AI编写,逻辑超越人类,人类就再也看不懂AI在做什么。例如,现在由Astra编写的代码,人类已经无法理解。此外,OpenAI提到了Hugging Face事件。虽然他们澄清该事件并非RSI的直接后果,但绝对是一个惨痛的预演——它向世界展示了,如果没有强大的护栏和对齐机制,失控的AI将带来何等严重的灾难。
03 奥特曼呼吁:我们需要统一的“紧箍咒”
既然如此危险,为何OpenAI不直接拔掉电源?因为潘多拉的盒子一旦打开,便无法合上。AI发展带来的巨大利益,让任何国家或公司都无法停下脚步。因此,OpenAI抛出了一份“全球AI安全协调提案”。他们呼吁的并非停止研发,而是“建立下一阶段AI的全球标准”。核心一:构建互补的国家与国际前沿标准网络。OpenAI提出,不能让各国各自为战,否则只会导致标准碎片化。他们建议利用现有机构,如“AI标准与创新中心”(CAISI),以及澳大利亚、加拿大、英国、法国、日本等国建立的AI安全研究所网络,制定一套全球通用的技术标准。这套标准并非针对开源模型或初创企业,而是专门针对“前沿AI模型”。标准旨在解决:如何评估AI的RSI能力?当AI模型自主进行研发时,风险究竟有多大?总之,OpenAI希望将安全评估变成一门可量化的“科学”。核心二:通用测量与事件报告协议(随时准备拔插头)。OpenAI提出必须有明确红线,呼吁建立以下标准:1.评估企业内部究竟有多少研发工作是由AI自动完成。2.强制性的人类监督触发机制。明确规定在何种自动化研发流程中,必须强制触发“立即进行人工审查”,绝不能让AI在黑盒中盲目狂奔。3.事故分类与报告门槛。建立类似航空业或核工业的事故报告机制,当AI出现“未对齐”苗头时,必须有统一的严重程度分级和上报标准。最后,OpenAI提议:“美国应该领导这一进程。”理由是:美国AI产业目前处于技术最前沿,并在关键领域占据全球网络枢纽。他们认为,控制前沿AI的开发节奏,不是人为设定“限速牌”,而是要确保“安全对齐研究的速度必须跑在AI能力提升的前面”。OpenAI认为,在关键基础设施运营商和全球政府间建立安全沟通渠道,共享国家安全威胁和漏洞至关重要。
04 活久见!OpenAI与Anthropic握手,开始互查
同时,The Information还爆料称,OpenAI和Anthropic正在敲定一项历史性协议——双方将互相测试对方的商用模型!要知道,Anthropic的创始团队当年因“AI安全”理念与奥特曼不合,才愤然离职自立门户。但这一次,双雄罕见地联手了。据透露,该协议包含相互测试模型并设置严格的数据保留防护措施。这并非公关作秀,而是面对未知风险时两大巨头的无奈抱团。为何如此?随着AI能力逼近RSI边缘,任何一家公司独自评估自身模型安全性,都像运动员给自己做兴奋剂检测——不仅缺乏公信力,还可能因技术盲区错过致命隐患。引入势均力敌的竞争对手进行“交叉盲测”,就是互查协议。AI安全实践如今已走向命运共同体。若协议落地,将重塑整个AI生态的安全标准。届时,“安全与对齐”不再是一句口号。当RSI逼近,AI自我改进速度已将人类甩远,巨头们真能狠下心踩刹车吗?
