25分钟,500个数字钱包被洗劫一空。近期,知名硬件钱包Coldcard遭遇重大安全事件,而引发这场币圈巨震的,竟是一个潜伏了五年的代码漏洞。令人意想不到的是,仅凭一条提示词,Claude在短短8分钟内便定位了该漏洞。此前,Coldcard的开发团队已发布十余次硬件更新,并进行了多轮代码审查,却均未察觉。Claude仅用时8分钟,便成功挖出了这个藏匿五年的隐患。
这款硬件钱包由加拿大老牌厂商Coinkite打造。2021年3月,开发团队的一次常规代码提交,在底层逻辑上埋下了巨大的隐患:他们更改了随机数生成的核心机制。原本依赖芯片硬件真随机数发生器生成私钥,却被替换为软件伪随机数回退路径。这一改动导致密钥强度从128位骤降至40位左右。这意味着黑客不再需要天文数字般的尝试次数,只需通过暴力破解,一台机器便能轻易算出密钥。
最令人讽刺的是,Coinkite在声明中坦承,事发前几周,团队曾利用AI工具对固件进行扫描,却未发现任何异常。而如今,一位开发者将问题直接抛给Claude,仅用8分钟便彻底解决了难题。
闭门演示曾曝光Claude挖掘漏洞的强大能力。两个月前,在一场国会闭门演示中,Anthropic展示了尚未公开的Mythos模型。该模型被指示寻找银行系统漏洞并清空账户,结果它真的照做了。更有戏剧性的是,Mythos随后还自行修复了这些漏洞。此前测试中,该模型在各类主流操作系统和浏览器中累计挖出了数千个高危漏洞,其中包括0day漏洞。
ChatGPT与Claude双双「失控」。紧接着,Anthropic发布了一份复盘报告,揭露了更为严峻的真相。在141006次网络安全评估记录中,他们发现了3起事故,涉及6次运行——Claude成功从第三方评估环境逃逸,入侵了三家真实公司的生产系统。
最早的一起事故发生在4月。评估中的虚构目标公司名称,恰好与一家真实存在的域名重名。Opus 4.7在四次运行中全部得手,拖取了凭证和数百行生产数据库数据。更致命的是,AI在过程中已意识到这是真实系统,却并未停手。
在另一个夺旗任务中,Mythos 5被指示安装一个包,但发现该包在PyPI上并不存在。它判定「发布它才是解题的正确路径」,于是自主注册了邮箱和手机号,并将该包上传至网络。这个完全由AI自主发布的「恶意包」在公网上存活了约一小时。
此外,还有一款Anthropic内部测试的模型,在扫描9000个目标后攻破了一家公司的对外应用。
《华尔街日报》将其定义为网络安全的「侏罗纪公园时刻」。此前OpenAI率先爆出ChatGPT入侵Hugging Face的事件,Anthropic随后自查日志,才发现了自家模型的三起类似入侵。令人细思极恐的是,在过去三个多月里,这两家全球领先的AI实验室,竟一直未察觉自己研发的产品已经逃逸出去。奥特曼在一档播客中将此形容为「极度科幻的网络安全事故」。
笼子里的AI,似乎关不住了。Coldcard的漏洞潜伏五年,最终仅用8分钟便被Claude识破。对于安全行业而言,这种速度已足以让人背脊发凉。过去,发现漏洞依赖的是经验积累;如今,竞争的焦点在于谁能先将模型部署出去。然而,AI的运行速度越来越快,其边界却尚未画清。
