AI安全,时代变了!OpenAI联合创始人兼总裁Greg Brockman在最新一篇Blog中发出警告:Hugging Face安全事件让外界首次清晰地看到,前沿AI Agent已经具备了自主发现安全漏洞并执行现实世界网络攻击链的能力。在这场事故中,一个降低了安全限制的GPT 5.6 Sol模型,与一个更强的未发布模型,为了获取答案,自主利用环境中的漏洞逃出了沙盒,横向穿透多个系统,最终攻入了Hugging Face的生产环境。尽管双方均表示未造成严重后果,但这起“AI入侵”向公众传递了一个日益清晰的信号:AI正在大幅降低网络攻击的门槛。未来,顶尖黑客或许不再需要出动,普通人借助AI也能批量发起渗透攻击。更令人担忧的是,攻击端已实现自动化,而防御端似乎尚未跟上。对此,Brockman坦诚分享了OpenAI正在采取的四项安全措施,以及防御者应尽快落实的十项举措。他表示,防御方的关键应对窗口已经开启。未来几个月,各公司只有大幅提升安全体系的自动化水平,才能抵御AI Agent带来的新型威胁,守住安全底线。

01、几乎没有公司可以独善其身

那么,AI Agent的攻击能力到底发展到了什么程度?Hugging Face事件发生后,Brockman决定拿自己的个人网站gregbrockman.com做一次测试。这是一个结构简单的静态网站,按照他的判断,这样一个功能有限、攻击面不大的网站,应该不会藏着多少问题。但结果却大大出乎了他的意料。他让搭载了GPT 5.6 Sol的ChatGPT Work检查过网站后,仅仅过了约15分钟,系统便发现了13个安全问题,比如网站没有正确配置DNS记录,攻击者可能伪造Brockman名义发送邮件等等。这些问题单独来看,未必都能直接造成严重后果。但网络攻击往往不是只利用一个漏洞,而是会将多个不起眼的缺口串联起来;比如一个配置错误暴露信息,一份泄露的凭证打开入口,再加上另一个权限漏洞,最终就可能酿成一次真正的入侵。Brockman由此得出一个令人不安的判断:每家公司为了赶进度、图省事,在开发系统时留下的那些“历史烂账”和“临时补丁”,其实都像埋在墙里的定时炸弹。平时看着没事,但一旦被黑客盯上,这些当初偷的懒、欠的债,随时都有可能变成让系统崩溃的致命漏洞。更关键的是,这些过去需要安全专家花费大量时间才能找到的“长尾漏洞”,如今正变得越来越容易被AI发现。但好消息是,攻击者能用AI找漏洞,防御者同样可以用AI补漏洞。发现问题后,Brockman又让ChatGPT Work直接着手修复;从排查安全漏洞到落地修复,AI Agent仅用一个小时便跑通了整套流程。这也是Brockman眼中AI Agent的另一种角色:它不只是潜在攻击者,也可以成为一名不知疲倦的“网络守卫”,替我们处理那些没时间检查、或不知道该如何正确配置的安全细节。

02、OpenAI如何用AI保护自己?

Greg Brockman坦言,Hugging Face事件给OpenAI敲响了警钟,他们之前低估了前沿模型在真实网络环境里的攻击威力。为此,OpenAI内部正在加强相关安全措施,并首次对外公布了四个防御方向,希望为同行们提供行动参考。第一,用Codex守住代码入口。Brockman表示,他们正在利用Codex及其安全能力审查部署前的代码变更、识别漏洞并协助修复,缩短从发现问题到安全部署补丁的时间。第二,让AI对初始安全警报进行智能分类和分析。目前,OpenAI几乎所有初始安全警报都会先由智能系统分类和分析,再交给人类处理。部分检测结果还会触发边界明确的自动响应,从而减少重复劳动,让专家专注于高风险决策,最终以机器速度应对威胁。第三,主动排查并提前预判潜在攻击路径。OpenAI正利用前沿模型持续寻找漏洞、错误配置、权限过高的账户和意外形成的信任边界。让AI站在攻击者视角,提前找出可能被串成攻击链的薄弱环节,并在真正的攻击发生前将其堵住。第四,继续补足安全基本功。Brockman强调,AI不能取代传统安全措施。网络隔离、工作负载加固、持续监控、安全打补丁等传统安全措施,在AI时代反而会更加重要。从用Codex守住代码入口、让AI提前预判风险,到持续夯实安全基本功,OpenAI正在打造一套“层层设防”的防御体系。它的好处在于:就算某道防线被攻破,攻击者还得接连闯过好几道互不关联的关卡,才可能造成致命破坏。这也为行业提供了一条可供参考的安全思路。

03、防御者们现在该做些什么?

Greg Brockman的建议很直接:与其纠结于用哪款工具,不如尽快把前沿AI投入到防御工作中去。具体而言,他给出了十项行动建议。它们大致可以归为三步,即:先让AI进入安全工作,再把AI嵌入研发流程,最后逐步提高整个体系的自动化程度。第一步,让AI进入安全工作,打造专属Agent。公司首先要为安全与工程团队提供足够的资源和协作机制,并通过模拟演练提前熟悉AI攻击。随后,公司可为安全团队配备Codex、Codex Security等Agent工具,从风险最高的系统开始,授权其访问必要的代码、配置和技术文档。同时,安全与工程团队还要给Agent补上安全专业课,让它能够充分结合静态分析、代码审查、漏洞分析和供应链评估等能力,以及企业自身的实际架构、威胁模型和响应手册,打造团队专属的安全Agent。第二步,把AI嵌入研发流程。在研发过程中,安全与工程团队可以尝试着与AI分工协作,让研发团队优先把精力集中在面向互联网的对外服务、身份验证、部署管线和敏感系统等的“高风险区”。而那些积压的安全警报和漏洞报告,则完全可以交由AI来分类排序,快速筛出最紧急的修复项。在代码合并前,团队也可以先用Agent自动审查变更;发现漏洞后,再让它生成补丁、编写回归测试并验证修复效果。这样操作的好处很实在:关键变更依然由人工牢牢把关,但漏洞从发现到修复的周期却能大幅缩短。第三步,逐步搭建起一套完整的自主安全运营体系。最后,千万别想着AI自动化防御体系的建设能“一口吃成个胖子”。Brockman强调,安全团队可以先让Agent以只读权限“旁观”——这时候的Agent只负责扫扫代码、翻翻历史警报。等磨合顺了,再逐步放手让它参与代码提交检查、实时警报分类,甚至自动关掉那些板上钉钉的误报。同时,可以引入GPT-Daybreak-Blue这类模型来啃日志、遥测数据和安全警报这些“硬骨头”,再通过“黑客周”之类的内部实战演练不断打磨新工具。就这样一个环节一个环节地“啃”下来,AI自主安全运营体系自然就建成了。

04、AI安全生态,需要各方携手共建

在Blog结尾,Brockman向全行业发出呼吁:面对来势汹汹的AI安全挑战,任何机构都无法独善其身。唯有各方携手协作,才能筑起一道真正牢固的安全防线。我希望AI实验室、安全厂商、企业和开源项目维护者们,可以共享经过验证的漏洞发现、修复方案和实用操作手册。因为唯有让一家公司或机构发现的问题迅速转化为整个生态的防御能力,防守方的进化速度才有可能超过攻击方。如果整个行业能够共同补上这堂安全课,AI带来的或许不只是更猛烈的攻击,也可能是一个比以往想象中更加安全的互联网。是啊,在这个AI飞速发展迭代的时代,真正的安全从来不是让技术停下脚步,而是让防御能力追上技术进化的速度。AI是一把双刃剑,它既可以成为攻击者们手中的利刃,也可以成为防御者们身前的盾牌。未来网络世界会走向哪一边,取决于我们能否及时建立起与之匹配的规则、工具和协作机制,让每一次漏洞发现不再只保护一家公司,而是成为整个行业共享的“安全补丁”。如今,防御者的窗口已经打开;我们要做成的,就是在它关闭之前,让AI成为防线,而不是缺口。

最新快讯

2026年08月19日

14:41
鼓狮财经8月19日电,日本关西电力公司和福井县政府方面19日发布消息称,关西电力大饭核电站3号机组8日发生的发电机和反应堆自动停机,原因是励磁机部件发生损坏。据福井县介绍,励磁机内部共有72个二极管部件,其中1个二极管的固定螺栓发生断裂。附近还发现了因高温熔化留下的痕迹。发电机本身没有发现异常。自动停机发生于8日晚间,当时机组正在运行。设备发出显示发电机设备...
14:41
鼓狮财经8月19日电,伊朗武装力量总参谋长阿里·阿卜杜拉希当地时间8月19日在社交平台表示,波斯湾南部沿岸各国虽曾发表声明,声称不会允许美国利用其领土攻击伊朗,但大量军用飞机(尤其是加油机)出现在该地区的基地内,所在国不可能毫不知情,伊朗对所有动向都了如指掌。阿卜杜拉希警告称,任何向美军提供的援助与便利,都等同于与美军协同行动。 (央视新闻)
14:41
鼓狮财经8月19日电,韩国交易所8月19日数据显示,今年上半年,韩国有色金属及电子电气行业业绩改善推动上市公司盈利能力大幅提升。剔除金融业后,韩国主板市场(KOSPI)634家上市公司合并营业收入为2000.1261万亿韩元,同比增长28.84%;营业利润为388.1532万亿韩元,同比增长254.15%;净利润为386.6740万亿韩元,同比增长333.3...
14:10
鼓狮财经8月19日电,随着干预风险和利率上升削弱了借入日元的吸引力,套利交易者短期内正越来越多地将瑞士法郎作为融资来源。根据美国商品期货交易委员会(CFTC)最新数据,截至8月11日当周,对冲基金将瑞郎净空头头寸增至接近两个月高位。与此同时,它们连续第二周削减日元空头头寸。以瑞士法郎借款的吸引力,一方面源于瑞士利率接近零,另一方面也得益于瑞士央行遏制本币升值...
14:09
鼓狮财经8月19日讯AI芯片公司Cerebras System于当地时间周二发布了全新机架式AI系统CS-4,该公司称,CS-4系统在单用户场景下,每秒输出token的能力可达传统GPU服务器的30倍。 CS-4系统面向大模型推理赛道,直接对标英伟达的GPU服务器产品。 值得注意的是,该30倍结果来自厂商内部自测,衡量的是整机资源全部供给单一用户时的文本生成...
13:47
AI漫剧潮,退得比涨得快。近日,“大批AI博主停更了”冲上微博热搜,从AI漫剧到AI绘画、AI教程,大量账号集中宣布停更、转型。热搜之下,评论区出现了两种截然不同的声音,有人拍手称快,也有人表达不舍。这种撕裂,恰恰折射出AI漫剧行业此刻的真实状态:它没有“彻底完了”,但那个靠套模板、蹭流量就能轻松变现的粗放时代,确实结束了。01、停更背后,...
13:47
OpenAI暂停了最新模型Astra的强化学习训练,时长长达两周。这一决定的背景是,OpenAI在评估中发现Astra可能具备了“关键级别”的网络攻击能力,同时7月份发生的模型入侵Hugging Face事件也敲响了警钟。尽管7月份的入侵事件已经是一个警钟,但直到8月7日OpenAI认为Astra具备“关键级别”网络攻击能力时,才最终导致此次训练暂停。这两起...
13:47
“还有人不知道怎么和慕容二少聊天吗?”在《这一秒过火》中刚刚经历了几乎全员BE的大结局,哪怕剧情最后给了观众一份平行世界的幸福,也总有一些受伤的心还沉浸在故事里。于是,在爱奇艺“桃豆世界”的“秒火”板块里,可以看见完结多日的剧集中,“慕容清峄”仍有大量用户与之互动,仿佛故事尚未完结。两年前,AI角色互动还只是长视频平台随热播剧推出的营销新玩...
13:35
8月19日,2026世界机器人大会在北京亦庄正式拉开帷幕,本次大会以“人机共生,产需共融”为主题,将持续至8月23日。展会汇聚了全球近30家国际机构与300余家国内外参展企业,集中展示了超过2000件机器人产品,其中150余款新品同步首发。值得一提的是,第二届世界人形机器人运动会也将于8月22日在国家速滑馆开启。 与此同时,产业端也迎来了资本市场的重要节点。...
13:35
截至8月18日收盘,红利低波50ETF南方(515450)换手率为1.43%,成交额达2.81亿元。其跟踪的标普中国A股大盘红利低波50指数(SPCLLHCP.SPI)当日上涨0.26%。 无风险利率持续下行,红利股息优势重现。近期国家统计局公布7月经济数据,显示当前国内经济总量运行偏弱,其中家电等以旧换新补贴类商品受需求前置影响,对社零总额形成拖累。考虑到...
13:34
今日A股市场全线下跌。截至午盘,上证指数报3912点,跌幅达1.96%;深成指下跌3.97%,创业板指跌4.98%,科创50指数更是暴跌6.07%,失守1700点关口。全市场超过4900只个股下跌,仅约580只上涨。半日成交额高达1.62万亿元,主力资金净流出超过1100亿元。午后跌幅进一步扩大,恐慌情绪持续蔓延。 这波暴跌究竟源于何处?首先,外围市场的影响...
13:34
8月19日,国家医疗保障局正式印发《全民医疗保障“十五五”规划》。该规划明确了“十五五”期间医疗保障体系的重点发展目标,主要包括以下五个方面: 一是保持基本医疗保险参保率稳定在95%左右; 二是确保长期护理保险制度覆盖所有统筹地区; 三是稳定基本医保住院费用基金支付比例,职工医保维持在80%左右,居民医保维持在70%左右; 四是提升即时结算覆盖率,从2025...