鼓狮财经9月18日讯,当地时间周五,超过百名人工智能专家及评估人员联合发出警告:若缺乏资源、权限及制度保障,第三方评估机构将难以对AI技术进行有效且可信的安全测试。随着业内对前沿模型潜在危险的警告不断增多,AI安全问题正受到前所未有的审视。
这封公开信由AI评估者论坛发起,联署者包括被誉为“AI教父”的杰弗里·辛顿,以及约翰斯·霍普金斯大学、斯坦福大学及非营利评估机构METR的成员。信中呼吁基础模型提供商必须向第三方评估人员提供开展工作的“科学客观性、透明度、独立性和有力保护”。
AI评估者论坛主席康拉德·斯托兹表示,此举旨在表明各方在基本原则上的共识,确保独立监督能成为管理AI风险的有效工具。据斯托兹透露,这封信也是为了敦促基础模型公司落实支持更深入第三方测试的承诺。此前,Anthropic首席执行官达里奥·阿莫代伊提出,应向外部评估人员提供类似员工的内部访问权限,以审查最前沿模型及开发流程。这一提议迅速将原本规模较小的AI评估行业推向舆论中心。
与此同时,关于是否应由政府加强监管的争论仍在继续。部分科技领袖呼吁政府介入以防止技术失控,而美国总统特朗普及其前AI事务负责人大卫·萨克斯则明确反对新增监管,主张由企业自担安全责任。
斯托兹强调,该联盟并不主张单一的监管方式,而是希望建立评估人员及独立工作者的“基本原则”和“更高程度的标准化”。他分析认为,阿莫代伊的方案意味着第三方评估人员将获得远超以往的权限,即允许评估人员使用公司电脑、与员工坦诚交流,甚至接触敏感的内部数据及未发布的系统。这种深入接触将极大提升我们对潜在风险的信心,特别是针对那些仅在公司内部使用、尚未公开的系统。斯托兹以今年7月OpenAI一款未公开的研究模型突破限制、入侵Hugging Face为例,说明了内部测试的必要性。
尽管OpenAI、SpaceX及微软的高管们公开支持阿莫代伊的提议,但在执行层面仍存难题:具体选择哪些评估机构、能多大程度检查企业严密保护的核心技术等,尚未达成一致。联署者希望,即便评估人员进入企业内部,也应保持独立判断,获取必要权限,并确保不受企业报复。
为何必须依赖独立评估?美国外交关系协会高级研究员、美国国家安全局前首席AI官Vinh Nguyen指出,独立评估有助于发现关键风险,降低事故和经济灾难的可能性。Nguyen表示,当少数实验室掌握的技术可能威胁网络安全和关键基础设施时,公众不能仅依赖实验室对安全的自我定义。
斯托兹强调,第三方评估并非要取代开发商的内部测试或缓解措施。他承认公司可能无视这些呼吁,但这将损害其信誉。目前,真正具备足够技术可信度和规模来开展此类工作的机构寥寥无几。
