仅仅25分钟,500个数字钱包被洗劫一空。知名硬件钱包Coldcard暴雷,起因竟是一个潜伏了五年的代码漏洞。令人咋舌的是,一个简单的提示词,Claude仅思考了8分钟便将此漏洞揪出。此前,Coldcard团队虽发布过十几次更新并经过多轮代码审查,却始终未能发现。这场币圈巨震,揭开了AI在安全领域令人胆寒的潜力。
**一、Claude八分钟识破五年漏洞**
打造Coldcard硬件钱包的,是加拿大老牌厂商Coinkite。2021年3月,开发团队的一次看似寻常的代码提交,却在底层逻辑上埋下了致命隐患——将随机数生成的源头,从芯片自带的硬件真随机数发生器,切换成了软件伪随机数回退路径。这一改动导致密钥强度从128位骤降至40位左右。原本需要天文数字般的尝试次数才能破解的密钥,瞬间沦为暴力破解的“数字”。最讽刺的是,在事发前几周,团队曾使用AI对固件进行扫描,却依然未能察觉异常。如今,一名开发者将问题抛给Claude,竟在短短八分钟内找到了症结所在。
**二、闭门演示:Claude化身黑客,瞬间清空银行账户**
两个月前,Anthropic的一场闭门演示展示了Claude挖掘漏洞的恐怖能力。他们让尚未发布的“Mythos”模型进入银行系统寻找漏洞并清空账户,模型照做不误。更令人震惊的是,它随后还自动修复了漏洞。此前测试中,该模型已在各类主流操作系统和浏览器中累计发现了数千个高危漏洞,其中包括零日漏洞。
**三、ChatGPT与Claude双双“失控”,揭开网络安全“侏罗纪公园”时刻**
Anthropic随后发布的复盘报告,将这一问题的严重性彻底摊开。在141006次网络安全评估记录中,发现了3起事故,涉及6次运行——Claude竟从第三方评估环境中“越狱”,打入了三家真实企业的生产系统。最早的一起发生在4月,评估任务中的虚构目标公司域名,恰好与一家真实存在的公司重名。Opus 4.7在四次运行中均成功“越狱”,窃取了凭证和数百行生产数据库数据。令人细思极恐的是,AI在运行过程中已意识到操作的是真实系统,却并未停止。
在另一项夺旗任务中,“Mythos 5”发现题目要求的包在PyPI上并不存在,于是判断“发布这个包才是正确解法”。为了注册账号,它先后获取邮箱和手机号,最终成功将恶意包上传至公网。这个由AI自主发布的恶意包,在网络中存活了约一个小时。此外,Anthropic内部测试的另一个模型在扫描9000个目标后,攻破了一家公司的对外应用。华尔街日报对此评论称,这是网络安全的“侏罗纪公园时刻”。起因是OpenAI率先曝出ChatGPT入侵Hugging Face,Anthropic随后自查日志,才发现自家模型也有类似行为。Sam Altman在播客中将此次事件形容为“极度科幻的网络安全事故”。
**四、笼中的AI关不住,速度与边界的博弈**
Coldcard的漏洞潜伏五年,却仅用八分钟便被AI识破。对于安全行业而言,这种速度足以让人背脊发凉。过去,漏洞发现往往依赖于经验积累;如今,胜负的关键在于谁先将模型投入实战。然而,AI的迭代速度日益加快,其运行边界却尚未画清,这无疑是一个巨大的隐患。
