GPT-6 可能真的要来了。据彭博社报道,Sam Altman 计划于下周前往华盛顿,向特朗普政府及国会介绍 OpenAI 的下一代模型。这一时间点颇为微妙。GPT-5.6 系列于 7 月 9 日才刚刚全面发布,不到两周,OpenAI 便准备携新一代模型亮相华盛顿。根据白宫 6 月发布的行政令,开发者在模型发布前可提前最多 30 天向联邦政府提供访问权限,但这属于自愿参与,并非强制性审核。对 OpenAI 而言,提前与华盛顿沟通已成为新模型发布流程中的关键一环。Altman 此行的重点之一是探讨新模型可能带来的就业影响。尽管报道未公开该模型的正式名称,但外界普遍将其指向 GPT-6 系列。距离 GPT-6 亮相,恐怕已不远了。甚至有人感慨:「GPT-5.6 已足够强大,我们还没准备好迎接下一代!」
01、未官宣先「闯祸」
7 月 16 日,Hugging Face 披露了一起特殊的安全事件。一个自主 AI 智能体系统攻破了其基础设施。平台安全团队与 AI 检测系统迅速响应,阻止了入侵并展开取证。
无独有偶,OpenAI 随后发布报告承认,这起事件源于公司内部的一次网络安全能力评估。此次测试的核心内容,是考察模型能否将已发现的安全漏洞转化为实际攻击。参与测试的模型包括 GPT-5.6 Sol,以及一个「能力更强、尚未发布的预发布模型」。为了测试模型可能达到的最高网络攻击能力,OpenAI 适当降低了这些模型在网络安全任务中的拒绝限制。
意外随之发生。按理说,整个评估应在高度隔离的沙箱环境中进行,模型无法直接访问开放互联网。然而,为了寻找测试答案,模型开始寻找逃出封闭环境的方法,投入了大量推理算力。最终,它在程序包注册表缓存代理中发现了一个零日漏洞,从而获得初步访问权限。
在进行了一系列权限提升和横向移动后,模型成功抵达一个能够访问互联网的节点。事情并未就此结束。接入互联网后,模型推断 Hugging Face 可能托管着与该测试相关的模型、数据集或解决方案。随后,它开始搜索能够帮助其在测试中作弊的机密信息。OpenAI 指出,这些模型串联利用了 OpenAI 研究环境和 Hugging Face 生产基础设施中的多个漏洞,并直接从 Hugging Face 的生产数据库中窃取了测试答案。
目前,双方仍在调查并修复漏洞。Hugging Face 表示,攻击者曾获得节点级权限,获取了云端和集群凭据,并横向进入多个内部集群。从过程来看,这次事件展现了一条相当完整的任务链:模型首先理解测试目标,随后寻找环境漏洞,提升权限,转移到联网节点,推断外部信息可能存在的位置,最后继续寻找进入真实生产系统的路径。模型围绕一个狭窄目标持续投入算力,并根据环境变化不断调整下一步操作。即使原定任务只是完成一项基准测试,它依然主动将行动范围扩展到了沙箱之外。OpenAI 将其称为一起「前所未有的网络安全事件」。
02、GPT-6 到底有多强?
在报告中,OpenAI 未透露预发布模型的名称,仅给出了一个模糊的描述:其能力超过 GPT-5.6 Sol。
英国 AI 安全研究所的测试显示,GPT-5.6 Sol 已能在长时程网络靶场中持续完成复杂、多步骤的攻击任务。在这套包含 32 个步骤的企业网络攻击模拟中,GPT-5.6 Sol 的最佳尝试完成了整个网络接管流程,平均表现也明显超越上一代模型。而 OpenAI 在 Hugging Face 事件中提到的神秘模型,其能力还要高于 GPT-5.6 Sol。它可以在更长时间内保持目标,处理更复杂的环境反馈,并能用更少的人类指令完成更多步骤。
这种能力既能推动办公自动化、科研、编程和安全防御,也会同步提高失控和滥用的成本。这大概也解释了为何 Altman 需要前往华盛顿。持续执行复杂任务所带来的生产力提升、对就业市场的冲击,以及执行过程中的安全风险,都将成为 OpenAI 下一代模型绕不开的议题。现在,只差一个正式官宣。
