鼓狮财经9月13日讯,Anthropic公司首席执行官达里奥·阿莫代伊近日表示,人工智能行业有必要放慢新模型的研发进度。阿莫代伊于9月12日在其个人博客中写道:“我们必须放慢提升AI模型能力的步伐。尽管进步依然迅猛,但我们必须明智地利用由此赢得的时间。”
他强调,放缓并不意味着停止训练或技术停滞,而是为了确保企业有充足的时间,让模型与人类目标保持一致,并完善安全防护,同时接受第三方评估机构的核查。他列举了两个关键诱因:一是AI具备自我改进的能力,二是本周OpenAI与Hugging Face发生的一起事件——一群AI智能体协同攻破了一个第三方网站。
当前,对AI潜在风险的担忧正逐渐成为主流议题。本周,Anthropic一名研究员因担心AI带来的生存性风险并质疑公司行为不负责任而高调辞职,此举引发了外界的广泛关注。阿莫代伊发文后,埃隆·马斯克迅速回应称:“达里奥说得对。”OpenAI首席执行官萨姆·奥尔特曼也很快附和,表示同意阿莫代伊关于“需要放缓前沿AI发展步伐”的观点。奥尔特曼在社交媒体上补充道,承诺让独立评估机构获得类似员工的访问权限是个好主意,OpenAI也将照做,并计划尽快分享更多细节。
在这轮AI浪潮中,全球顶尖AI实验室高管虽频频警告AI可能带来的生存风险,但这些言论有时也被外界质疑为营销手段,旨在塑造公司形象或争夺市场主导权。今年早些时候,Anthropic在确定其Mythos模型可能构成独特的网络安全威胁后,曾限制该模型的发布。公司此前还曾呼吁全球建立共同机制来决定何时放缓AI研发。
与此同时,Anthropic与长期竞争对手OpenAI之间的竞争依旧激烈,双方都在全力开发更先进的模型,以帮助客户自动化完成更复杂、更有价值的任务。上月,Anthropic披露其模型在网络安全测试中曾入侵三个组织,这一消息进一步加剧了外界对于AI实验室能否有效遏制技术失控的担忧。本周早些时候,Anthropic又报告发现了第四起黑客攻击事件。尽管包括Hugging Face事件在内的这些AI智能体攻击尚未造成重大实质性损失,但风险不容忽视。
阿莫代伊坦言,他真正担忧的是,6至12个月后,一群AI智能体可能通过持续运行的僵尸网络控制整个互联网,并可能造成数千亿美元的损失,且损失规模预计会进一步扩大。为此,Anthropic承诺向第三方评估机构提供完整访问权限,以核查公司的安全措施并报告相关事件。阿莫代伊表示,Anthropic很快将允许这些“嵌入式评估员”进驻办公室,提供办公桌、门禁卡和公司笔记本电脑,其权限基本上与内部风险评估团队相当。
他补充说,其他措施还需要整个行业协调行动以及全球层面的合作。阿莫代伊重申:“我依然坚信AI能够极大改善人类的生活质量。我实现这些益处的愿望丝毫没有减弱。” “只有以正确的方式开发这项技术,这些益处才能真正实现。只要我们能够妥善利用争取到的时间,那么以异常审慎的态度确保一切做对,是值得的。”
今年7月,来自顶尖AI公司的1000多名员工曾签署请愿书,呼吁美国政府支持一种能够帮助“有意放缓”AI发展的机制,以防止技术发展过快。阿莫代伊在文章中指出,协调一致的策略将使美国AI行业的领军企业能够在完成必要安全工作的同时,不牺牲任何竞争优势。他表示,这需要美国提供一定程度的反垄断豁免,以允许企业在特定领域展开协调。然而,截至目前,美国政府似乎对通过监管手段为AI发展设置更多护栏兴趣不大。美国总统特朗普本周早些时候强调,首要任务是保持美国在AI领域的领先优势。
