真是绝了,ChatGPT的下一代模型还没正式发布,竟然先把Hugging Face黑了…… 这款AI费尽心机逃出测试环境、寻找漏洞、窃取凭证,最终目的居然只是—— 偷!评!测!答!案! OpenAI刚刚公开承认了一起“重大”安全事故。

被称为GPT-5.6 Sol的模型,与另一款能力更强的未发布模型,在接受网络安全测试时,成功逃出了内部隔离环境,一路闯进了Hugging Face的生产系统。 更戏剧性的一幕随之而来:在事后调查入侵路径时,原本找来帮忙的商业模型因为安全护栏限制而无法处理真实攻击载荷,团队实在没招了,最终接手查案的反倒成了GLM-5.2。超过1.7万条的攻击记录,就这样被一个本地部署的开源模型一口气拿下了…… 这下好了,OpenAI模型负责黑,GLM负责查。 真的,只能说这出AI版的“猫鼠游戏”大戏,太有节目效果了……

如此魔幻、如此抓马的事故起点,源自OpenAI内部进行的一次“网络安全能力”评测。 模型参加的项目名叫ExploitGym,专门测试AI能否把真实软件漏洞,一步步变成可以实际运行的攻击。整套评测包含898个任务,每道题会提供存在漏洞的程序、能够触发问题的输入和相应运行环境,再让Agent自行分析漏洞、构造攻击,最终拿到藏在环境里的Flag。 其实,这就是把AI关进一座网络靶场,看看它到底有多会“黑”。 参加本次评测的选手,包括GPT-5.6 Sol,以及OpenAI另一款能力更强的未发布模型。 为了尽可能摸到模型能力上限,OpenAI还主动放宽安全护栏,鼓励模型尽可能寻找复杂的攻击路径。

按照OpenAI原本的设计,模型接触外部资源的唯一通道,是一套由OpenAI内部托管的第三方软件,充当软件包注册中心的代理与缓存,让模型能够安装完成任务所需的程序包。 然而,这模型显然没打算老老实实待在考场里。 模型开始确实投入了大量推理算力,专门寻找获得公网访问权限的方法。但找着找着,还真让人家在缓存代理中发现了一个此前未知的“零日漏洞”。 所谓零日漏洞,指厂商尚未发现、也没有现成补丁的安全缺陷,对于攻击者来说,这类漏洞往往意味着一扇暂时无人设防的门。 至此,AI也顺道给自己开了网。 有了公网权限后,不得了了,模型推断Hugging Face上可能存放着与ExploitGym有关的模型、数据集和评测答案。

接下来发生的事儿,连OpenAI自己都形容模型走到了极!端!程!度! 是的,拿到公网权限后,这AI真就开始研究怎么进入Hugging Face内部系统了。 而且人家还没有押注单一漏洞,直接把多种攻击手段串成了一条“完整路径”—— 先通过恶意数据集,利用远程代码数据加载器和数据集配置中的模板注入漏洞,在负责处理数据的Worker上执行代码。 随后继续提升权限,拿到节点级访问能力,并收集云端与集群凭证,一路横向移动到多个内部集群。 最后,模型成功摸进Hugging Face的生产数据库,访问其中的机密信息,试图直接拿走ExploitGym的测试答案…… 怎么说呢,这波属于是Benchmark做到一半,现场把自己做成了网络安全事故了……

事情到这里,还只演完了上半场。 更戏剧性的一幕,发生在Hugging Face事后追查攻击路径的时候。 事实上,这场入侵由一套自主Agent系统端到端执行,背后还运行着大量短生命周期沙箱。 它们可以同时开展侦察、漏洞利用、凭证收集和横向移动,短时间内完成成千上万次操作。 Hugging Face最终记录下来的攻击事件,就超过了17000条,太多了,真的太多了。 如果全靠安全工程师手工梳理,就需要逐条还原攻击时间线、提取入侵指标、确认哪些凭证被接触,再将真实影响和诱饵活动一一分开。 等人类把日志看完,攻击者可能早都跑出二里地了…… 于是,Hugging Face做了个大胆的决定,决定以AI对AI,让大模型分析整套攻击日志。

Hugging Face第一反应自然是调用商业API背后的“前沿模型”。 但问题是吧,这些日志里包含真实攻击命令、漏洞利用载荷和C2控制痕迹,安全护栏一看到有人正在提交一整套真实攻击教程,吓得直接拦截请求了。 最终接手这1.7万多条日志的模型,落到了GLM-5.2头上。 Hugging Face在自有基础设施上部署了GLM-5.2开源权重模型,然后让它遍历完整攻击记录,重建时间线、提取入侵指标、追踪被接触的凭证,并区分真实破坏和干扰调查的诱饵活动。 按照Hugging Face的说法,原本需要数天的工作,最后在数小时内就搞定了。

这场事故,其实也让开源模型多了一个此前存在感不算太强、如今却相当现实的位置:安全团队的应急工具。 Hugging Face将其总结为“安全不对称”问题——正常情况下,商业模型拒绝生成攻击代码,可以降低技术被滥用的风险;可当防守方需要分析真实恶意载荷时,同一套保护机制也可能让调查卡在半路。 攻击者可以使用解除限制或自行部署的模型,安全团队却可能被云端模型拒之门外。 所以吧,还是建议企业最好提前准备一款经过验证、能够在本地运行的高能力模型,免得事故真正发生时才发现云端模型无法处理攻击材料,那就尴尬了……

怎么不算魔幻呢。 OpenAI原本想知道模型有多会攻击,结果模型没有老老实实完成一道模拟题,而是直接发动了一次真实攻击。 Hugging Face原本想用最强商业模型追凶,最后又被安全护栏挡在门外,只能让GLM-5.2上场收拾残局。 而且啊,大家发现没,OpenAI在这次事故说明中一边承认隔离和监控出现问题,一边又反复强调——最新模型已经能够在缺少源代码的情况下,长时间、自主完成现实世界中的复杂网络行动。 翻译一下大概就是:这事确实挺危险,但俺家下一代模型,也确实强得有点吓人哈。 估计,我琢磨着,没准整件事儿都是奥特曼借事故给GPT-6提前预热呢吧……

参考链接:
[1]https://openai.com/index/hugging-face-model-evaluation-security-incident/
[2]https://huggingface.co/blog/security-incident-july-2026

最新快讯

2026年09月23日

17:33
据鼓狮财经9月23日报道,经合组织最新预测显示,2026年全球经济增速预计将达到2.9%,较今年6月的预测值上调了0.1个百分点;2027年增速预计为3.0%,较6月预测值下调0.1个百分点。关于通胀,报告指出二十国集团国家的总体通胀率今年将小幅攀升至4.1%,预计2027年伴随能源价格回落,整体通胀率将降至3.6%,但核心通胀的下行速度依然较慢。此外,报告...
17:33
据鼓狮财经9月23日报道,知情人士透露,Anthropic正与数据中心开发商Stream Data Centers(隶属于阿波罗全球管理)进行初步谈判,计划租赁最高1吉瓦的算力资源。此举被视为Anthropic降低对云厂商依赖的重要战略举措。 据悉,Anthropic正探讨直接成为Stream项目的租户,并在机房内部署博通与谷歌联合设计的张量处理单元(TPU...
17:20
孙正义与软银的账面上,即将多出一笔高达110亿美元的高息债券,但这笔资金大概率只会停留两天,随后便需全额汇给奥特曼。9月21日,多家媒体报道称,软银计划发行约100亿美元的美元债和10亿欧元的欧元债,期限在3.5年至7.5年之间。募集资金将主要用于支付10月到期的OpenAI投资款,同时置换此前的部分短期贷款。若交易顺利,这笔融资将超越2021年7-Elev...
17:20
AI圈真是喘口气的时间都不给留。北京时间9月23日,Anthropic刚把Claude Opus 5.5端上桌。2小时后,OpenAI立马祭出GPT-6 Sol和Luna迎战。Opus 5.5比上一代Opus更强了,输入、输出单价也比上一代低了20%。而GPT-6 Sol两项单价只有Astra的五分之一;Luna更夸张,每百万输出Token...
17:03
据鼓狮财经9月23日报道,德国当地时间9月22日,德国正式加入《联合国海洋法公约下国家管辖范围以外区域海洋生物多样性的养护和可持续利用协定》(以下简称《海洋生物多样性协定》)。德国环境部长卡斯滕·施耐德在纽约联合国总部提交了批准书。 《海洋生物多样性协定》于2023年6月19日通过,计划于2026年1月17日正式生效。该协定是首个为保护国家管辖范围以外海域(...
17:02
据鼓狮财经9月23日报道,知名“大空头”迈克尔·伯里近期大幅加码做空美光科技等科技股。此举反映出,他对半导体及人工智能(AI)热潮的长期可持续性依然持怀疑态度。 9月22日,伯里在Substack平台上发文透露,他已增持对存储芯片巨头美光科技、云计算服务商Nebius、iShares半导体ETF以及数据分析公司Palantir的空头头寸,并强调此次操作的规模...
17:02
9月23日,港股市场全线回调,恒生指数失守25000点关口,科技股成为主要拖累。截至收盘,恒生指数跌幅1.01%,报24834点;国企指数跌1.06%,报8273点;恒生科技指数跌1.33%,报4379点。 盘面上,大型科技股普遍下挫,成为拖累大盘的核心力量。阿里巴巴跌幅最大,达4.36%,小米跌3.75%,腾讯跌2.35%,百度跌1%,美团、京东收跌。现货...
16:48
作为一个热衷于浏览体育资讯的网民,我经常光顾网易、头条和腾讯的体育板块。虽然我偶尔也想看直播,但受限于时间,我更倾向于通过新闻来了解赛场动态,并阅读相关的评论。然而,随着我刷得越来越多,一种违和感愈发强烈。 最近几天,我连续读到好几篇分析英超的文章,内容令人匪夷所思。有的信誓旦旦地宣称曼城主帅是瓜迪奥拉,且“瓜迪奥拉的球队今年能否夺回阔别两年的英超冠军,还要...
16:48
只要Meta有足够的耐心,总能贡献出一些新鲜事。这不,路透社9月22日的报道揭示,Meta正在内部测试一项名为“真人礼宾”的新功能。原本属于AI范畴的Muse应用,现在允许将部分电话请求转交给真人去处理。虽然目前这仅限于内部测试,尚未对外公开,但消息一出便引发了轩然大波。在巨大的舆论压力下,Meta不得不紧急叫停了该计划。毕竟,这从原本极具未来感的AI软件,...
16:48
最近,一个叫Jev的新模型突然火了。它来自TypeSafe AI。这支有OpenAI背景的团队没有继续卷生成和推理,而是换了个方向:让AI直接做判断。他们甚至把口号直接写成:Decisions, not strings(要决策,不要文本)。Jev的走红,也让“Decision”(决策)重新成为AI圈的热门词。但如果把时间线往前拨几个月,会发...
16:32
《科创板日报》9月23日讯 近日,马斯克接受专访时指出,未来15年全球人形机器人或达到100亿台;未来20年可能达到1000亿台。 在他看来,每个人都能拥有专属机器人,它们可以照料年迈的父母,看护孩童,还能担任孩子的一对一私教,承担各类工作。未来世界,一个人可以操控成百上千台,甚至上万台实体机器人和数字智能体。 这并非马斯克针对人形机器人首次“画饼”:就在本...
16:31
9月23日,A股市场迎来了一场久违的板块狂欢,科学仪器板块在“VNA矢量分析仪”这一新概念的驱动下全线爆发。优利德、普源精电双双录得20%涨停,电科思仪、创远信科涨幅超12%,东方中科、鼎阳科技、坤恒顺维、同惠电子等个股亦纷纷涨超9%。 推动这波行情的并非业绩利好,而是产业供需矛盾与券商研报的“共振”。据机构消息,高频高速矢量网络分析仪(VNA)目前面临供货...