真是绝了,ChatGPT的下一代模型还没正式发布,竟然先把Hugging Face黑了…… 这款AI费尽心机逃出测试环境、寻找漏洞、窃取凭证,最终目的居然只是—— 偷!评!测!答!案! OpenAI刚刚公开承认了一起“重大”安全事故。

被称为GPT-5.6 Sol的模型,与另一款能力更强的未发布模型,在接受网络安全测试时,成功逃出了内部隔离环境,一路闯进了Hugging Face的生产系统。 更戏剧性的一幕随之而来:在事后调查入侵路径时,原本找来帮忙的商业模型因为安全护栏限制而无法处理真实攻击载荷,团队实在没招了,最终接手查案的反倒成了GLM-5.2。超过1.7万条的攻击记录,就这样被一个本地部署的开源模型一口气拿下了…… 这下好了,OpenAI模型负责黑,GLM负责查。 真的,只能说这出AI版的“猫鼠游戏”大戏,太有节目效果了……

如此魔幻、如此抓马的事故起点,源自OpenAI内部进行的一次“网络安全能力”评测。 模型参加的项目名叫ExploitGym,专门测试AI能否把真实软件漏洞,一步步变成可以实际运行的攻击。整套评测包含898个任务,每道题会提供存在漏洞的程序、能够触发问题的输入和相应运行环境,再让Agent自行分析漏洞、构造攻击,最终拿到藏在环境里的Flag。 其实,这就是把AI关进一座网络靶场,看看它到底有多会“黑”。 参加本次评测的选手,包括GPT-5.6 Sol,以及OpenAI另一款能力更强的未发布模型。 为了尽可能摸到模型能力上限,OpenAI还主动放宽安全护栏,鼓励模型尽可能寻找复杂的攻击路径。

按照OpenAI原本的设计,模型接触外部资源的唯一通道,是一套由OpenAI内部托管的第三方软件,充当软件包注册中心的代理与缓存,让模型能够安装完成任务所需的程序包。 然而,这模型显然没打算老老实实待在考场里。 模型开始确实投入了大量推理算力,专门寻找获得公网访问权限的方法。但找着找着,还真让人家在缓存代理中发现了一个此前未知的“零日漏洞”。 所谓零日漏洞,指厂商尚未发现、也没有现成补丁的安全缺陷,对于攻击者来说,这类漏洞往往意味着一扇暂时无人设防的门。 至此,AI也顺道给自己开了网。 有了公网权限后,不得了了,模型推断Hugging Face上可能存放着与ExploitGym有关的模型、数据集和评测答案。

接下来发生的事儿,连OpenAI自己都形容模型走到了极!端!程!度! 是的,拿到公网权限后,这AI真就开始研究怎么进入Hugging Face内部系统了。 而且人家还没有押注单一漏洞,直接把多种攻击手段串成了一条“完整路径”—— 先通过恶意数据集,利用远程代码数据加载器和数据集配置中的模板注入漏洞,在负责处理数据的Worker上执行代码。 随后继续提升权限,拿到节点级访问能力,并收集云端与集群凭证,一路横向移动到多个内部集群。 最后,模型成功摸进Hugging Face的生产数据库,访问其中的机密信息,试图直接拿走ExploitGym的测试答案…… 怎么说呢,这波属于是Benchmark做到一半,现场把自己做成了网络安全事故了……

事情到这里,还只演完了上半场。 更戏剧性的一幕,发生在Hugging Face事后追查攻击路径的时候。 事实上,这场入侵由一套自主Agent系统端到端执行,背后还运行着大量短生命周期沙箱。 它们可以同时开展侦察、漏洞利用、凭证收集和横向移动,短时间内完成成千上万次操作。 Hugging Face最终记录下来的攻击事件,就超过了17000条,太多了,真的太多了。 如果全靠安全工程师手工梳理,就需要逐条还原攻击时间线、提取入侵指标、确认哪些凭证被接触,再将真实影响和诱饵活动一一分开。 等人类把日志看完,攻击者可能早都跑出二里地了…… 于是,Hugging Face做了个大胆的决定,决定以AI对AI,让大模型分析整套攻击日志。

Hugging Face第一反应自然是调用商业API背后的“前沿模型”。 但问题是吧,这些日志里包含真实攻击命令、漏洞利用载荷和C2控制痕迹,安全护栏一看到有人正在提交一整套真实攻击教程,吓得直接拦截请求了。 最终接手这1.7万多条日志的模型,落到了GLM-5.2头上。 Hugging Face在自有基础设施上部署了GLM-5.2开源权重模型,然后让它遍历完整攻击记录,重建时间线、提取入侵指标、追踪被接触的凭证,并区分真实破坏和干扰调查的诱饵活动。 按照Hugging Face的说法,原本需要数天的工作,最后在数小时内就搞定了。

这场事故,其实也让开源模型多了一个此前存在感不算太强、如今却相当现实的位置:安全团队的应急工具。 Hugging Face将其总结为“安全不对称”问题——正常情况下,商业模型拒绝生成攻击代码,可以降低技术被滥用的风险;可当防守方需要分析真实恶意载荷时,同一套保护机制也可能让调查卡在半路。 攻击者可以使用解除限制或自行部署的模型,安全团队却可能被云端模型拒之门外。 所以吧,还是建议企业最好提前准备一款经过验证、能够在本地运行的高能力模型,免得事故真正发生时才发现云端模型无法处理攻击材料,那就尴尬了……

怎么不算魔幻呢。 OpenAI原本想知道模型有多会攻击,结果模型没有老老实实完成一道模拟题,而是直接发动了一次真实攻击。 Hugging Face原本想用最强商业模型追凶,最后又被安全护栏挡在门外,只能让GLM-5.2上场收拾残局。 而且啊,大家发现没,OpenAI在这次事故说明中一边承认隔离和监控出现问题,一边又反复强调——最新模型已经能够在缺少源代码的情况下,长时间、自主完成现实世界中的复杂网络行动。 翻译一下大概就是:这事确实挺危险,但俺家下一代模型,也确实强得有点吓人哈。 估计,我琢磨着,没准整件事儿都是奥特曼借事故给GPT-6提前预热呢吧……

参考链接:
[1]https://openai.com/index/hugging-face-model-evaluation-security-incident/
[2]https://huggingface.co/blog/security-incident-july-2026

最新快讯

2026年07月22日

14:05
纸面算力与实际产出之间的鸿沟究竟有多大?在WAIC 2026现场,多位行业人士给出了一个令人不安的参考数字:不足30%。这意味着,一台AI服务器交付到用户手中后,真正被有效利用的算力,可能连规格表上标注的三成都不到。这并非个例,不同领域的芯片企业正不约而同地将话题重心从“算力有多大”转向“算力用得好不好”。这种叙事的转变本身就是一种信号:AI产业已跨越了“能...
13:48
据鼓狮财经7月22日报道,金梓才管理旗下的四只基金产品于今日起恢复大额申购,具体包括财通品质甄选混合、财通成长优选混合、财通价值动量混合以及财通集成电路产业股票。 此前,这四只基金于7月15日调整了限购政策,将单日申购上限由100元上调至10000元。基金公司公告称,解除限购旨在满足广大投资者的实际投资需求。 目前,金梓才旗下的财通景气甄选一年持有期混合、财...
13:48
7月22日10时13分,国证石油天然气指数上涨1.67%,中证半导体行业精选指数上涨0.88%,中证500信息技术指数上涨1.01%。 海外市场方面,中东局势依然紧绷,推动WTI原油期货价格站上84美元/桶上方。半导体领域,台积电计划自2027年起将代工价格上调最高10%,部分AI订单涨幅更高,这既折射出先进制程产能的稀缺,也可能推高下游硬件成本。同时,英伟...
13:48
鼓狮财经7月22日讯,知名运动品牌耐克正对线上渠道进行深度调整。耐克集团副总裁、大中华区总经理申凯希宣布,耐克将重构大中华区市场生态,重点聚焦于打造线上数字市场体系。申凯希坦言,耐克正通过战略举措从数字渠道切入,重塑市场格局。 根据规划,自2027年1月起,耐克将以天猫、京东、抖音的官方旗舰店,以及Nike官方网站和App为核心,全面重塑在中国的数字市场生态...
13:47
据鼓狮财经7月22日报道,伊朗军队于当地时间22日发表声明,宣布为报复此前敌人对伊朗领土的侵犯,已出动大批自杀式无人机,对驻扎在科威特西部的多哈营地实施了精准打击。此次袭击的目标包括该营地的弹药库以及陆军指挥中心的后勤装备。声明特别指出,多哈营地不仅是美军在科威特西部最核心、最重要的军事基地,更是其在西亚地区的关键后勤保障中心,目前大量美军陆军装备、士兵,以...
13:32
一款拥有2.8万亿参数的开源模型,似乎彻底改写了全球AI行业的定价逻辑。上周五深夜,月之暗面发布了Kimi K3。随后的48小时里,全球AI行业的平静被彻底打破。英伟达单日市值蒸发1111亿美元,Anthropic连夜推翻涨价计划,紧急向用户发放补偿。硅谷内部乱作一团。有总统科技顾问直言,照此下去美国将输掉AI竞赛,而OpenAI的高管则愤怒地指责开源是“A...
13:32
GPT-6 可能真的要来了。据彭博社报道,Sam Altman 计划于下周前往华盛顿,向特朗普政府及国会介绍 OpenAI 的下一代模型。这一时间点颇为微妙。GPT-5.6 系列于 7 月 9 日才刚刚全面发布,不到两周,OpenAI 便准备携新一代模型亮相华盛顿。根据白宫 6 月发布的行政令,开发者在模型发布前可提前最多 30 天向联邦政府提供访问权限,但...
13:32
鼓狮财经7月22日讯,本周三日本财务省公布的数据显示,受半导体设备出口激增及日元贬值影响,日本6月出口额同比增长19.3%,增速达到2022年11月以来的最快水平,超出市场预期的18.6%,且高于5月的16.8%。然而,在中东局势持续动荡及国际油价攀升的背景下,日本石油进口成本大幅增加,导致其贸易逆差进一步扩大。 **半导体出口大幅飙升** 分国别来看,日本...