鼓狮财经9月15日讯,针对当前AI安全争议持续发酵的现状,SpaceX首席执行官埃隆·马斯克提出了一项新主张:让竞争对手互相把关。他建议头部AI公司在模型正式发布前进行交叉测试,并认为这一机制应尽快推向全球,且中国的参与不可或缺。
当地时间9月13日至15日,马斯克在洛杉矶举行的“All-In”峰会上以视频形式远程出席。会上,他就前沿AI模型的安全问题提出了一套治理框架:领先的AI公司在发布前应相互测试对方的模型,由竞争对手负责发现并提出安全隐患。马斯克表示,这种“同行评审”机制无需等待新立法,可立即启动。
马斯克解释道,所有AI公司都拥有测试工具,用于检验模型是否会协助制造生物武器或核武器,是否存在欺骗行为。“让每家公司都用别家的测试工具跑一遍,可能是我们确保自身安全所能做的最好的事,应当尽快推动。”他形容,这意味着AI公司不再“自己给自己的作业打分”,而是至少由竞争对手来“批改”。一旦发现问题,便可拉响警报。
在具体操作层面,马斯克建议模型开发方在发布前向同行提供API访问权限。若被指出的问题迟迟未获解决,竞争对手可以公开表态,宣称该模型的发布并不安全。在他看来,这种公开质疑将带来巨大的法律责任压力,从而形成事实上的约束力。
马斯克同时强调,该框架若要真正有效,必须把中国纳入其中。他指出:“我们或许应当与中国达成一项协议,这会是一种同行评审:领先的AI公司在发布前相互测试各自的模型。”
谈及各公司的安全投入,马斯克对AI大模型开发商Anthropic给予了相对正面的评价,认为其在安全方面的投入比ChatGPT开发商OpenAI更多。但他同时也指出,即便是Anthropic也承认对其自身模型感到担忧。
马斯克所提的“互测”机制在行业内已有雏形。此前,OpenAI与Anthropic曾联合发布过安全评估报告。双方相互开放API权限并放宽部分外部防护措施,利用各自内部的测试工具评估对方已公开发布的模型,并同步公布结果。这被视为头部实验室首次向直接竞争对手开放内部测试。
