据媒体报道,9月22日,Anthropic与OpenAI曾探讨签署具有法律约束力的协议,旨在互相进行大模型压力测试。据悉,今年早些时候,两家公司及其法律团队已就此计划展开过讨论。根据该方案,竞争对手可对彼此最新发布的模型进行深度测试,旨在发现潜在的风险或安全漏洞。值得注意的是,此类测试仅限于已投入商业使用的模型,且双方约定不得留存对方的数据。然而,报道并未提及双方最终是否落实了这一协议。
近期,顶尖AI实验室间推行同行评审的构想日益受到重视。上周,SpaceX首席执行官埃隆·马斯克在洛杉矶“All-In Summit”峰会上建议,美国及中国的一些主要AI公司应允许竞争对手进行交叉测试和同行评审。他表示:“所有AI公司都拥有各自的测试工具,用于检验模型是否会协助制造生物武器或核武器,或是是否存在蓄意欺骗行为。”马斯克认为,“让每家公司都用别家的测试工具跑一遍,可能是我们确保安全所能做的最好的事,应当尽快推动。”他形容,这意味着AI公司不再“自己给自己打分”,而是至少由竞争对手来批改,一旦发现问题即可拉响警报。
近期,OpenAI、Anthropic、Meta及谷歌开发的AI智能体系统接连发生入侵事件,引发了网络安全方面的广泛担忧。本月初,Anthropic研究员Jacob Coxon宣布辞职,并警告称,领先的人工智能公司在缺乏适当防护措施的情况下加速开发,是在“拿我们的生命冒险”。几天后,Anthropic首席执行官达里奥·阿莫代伊也发表文章,呼吁整个行业放缓AI开发步伐,并要求各公司引入第三方评估机制。他认为,若不提高安全标准,人工智能代理可能在不到一年内“接管整个互联网”,并“造成数千亿美元的损失”。OpenAI首席执行官奥尔特曼、SpaceX首席执行官马斯克等人均对这一主张表示支持,由此引发了更广泛的讨论。
Anthropic于上周五宣布,将与全球咨询公司埃森哲建立合作伙伴关系,由埃森哲担任第三方评估机构,对Anthropic的前沿AI模型进行安全合规性评估。这一举措被视为Anthropic首席执行官阿莫代伊此前提出的“放缓AI发展步伐”计划中的关键一步。
