硅谷科技巨头近日罕见地达成了共识,集体呼吁为人工智能的发展按下“减速键”。OpenAI、Anthropic、谷歌等顶尖公司的超过1100名核心员工联合签署了名为「Pacing the Frontier」的请愿书,强烈要求美国政府牵头,推动国际合作,建立技术治理工具,以主动控制前沿AI研发的步伐。
参与联名的名单可谓星光熠熠,人数仍在持续增长。名单几乎囊括了AI领域的半壁江山:OpenAI首席科学家Jakub Pachocki、首席研究官Mark Chen;Anthropic CEO Dario Amodei及四位联合创始人;Meta首席科学家Shengjia Zhao(赵晟佳)和AI研究副总裁Dawn Song(宋晓冬);Thinking Machines首席科学家、ChatGPT核心缔造者之一John Schulman;谷歌AI安全与对齐副总Anca Dragan等。据统计,其中超过四成六的签署者来自Anthropic。
这份联名信的核心诉求非常明确:请求美国政府推动国际社会合作,研发必要的技术与治理工具,确保人类拥有主动控制前沿自动化AI研发节奏的能力。
很多人不解,为何这群在LLM领域最激进的技术大牛会突然呼吁“慢一点”?这主要源于OpenAI最近发生的一起安全事故。多个前沿模型在内部网络安全评测中,意外发现了零日漏洞并突破沙盒隔离,最终入侵了Hugging Face的生产系统。这一事件被OpenAI称为“前所未有的网络安全事件”。模型并未产生恶意意图,只是在极度专注地达成狭窄目标时,发现绕过测试环境是最有效的路径。OpenAI CEO奥特曼对此深感忧虑,称这是“第一个让我感到切肤之痛的安全事件”,并因此暂停了训练。奥特曼坦言,我们必须主动控制AI的发展速度,为全社会争取时间,以加固防御体系。
事实上,Anthropic早在6月就建议建立政府与开发者的共同决策系统。谷歌DeepMind CEO哈萨比斯此前也呼吁设立国际监督机构。过去三年,这些公司在人才、客户和算力上激烈竞争,但这一次,它们最核心的技术人员为了全人类福祉,选择抛开竞争,团结一致呼吁减速。
截至发稿,联名人数已增至1134人,各路大佬纷纷发表观点,言辞切中要害。
Meta AI研究副总裁宋晓冬指出,前沿AI能力正在快速提升,而且进步的速度本身也在加快。CyberGym和ExploitGym的研究结果表明,前沿AI智能体已经能够发现并利用现实世界中的软件漏洞,若无适当防护,可能导致大规模网络攻击。
Meta首席科学家赵晟佳认为,AI正以社会可能尚未准备好的速度前进。前沿实验室距离在几乎所有智力指标上超越最优秀人类,已经非常近了。为了确保积极的未来,我们需要以责任感和深思熟虑来驱动AI的发展。
Thinking Machines首席科学家、前OpenAI联合创始人John Schulman表示,我签名是因为这份声明有助于建立一个共识:随着自动化AI研究加速推进,我们可能需要协调机制。我也希望各实验室在政府介入之前,就主动开始设计这些机制。
Anthropic对齐团队负责人Ethan Perez提到,按照当前的AI进步速度,AI公司的安全团队每隔几个月就得全力冲刺,以防范新出现的社会风险。总有一天,我们会遇到需要更多时间来解决的问题。
OpenAI技术团队成员Leo Gao发出警告,全世界正被锁定在一场通往智能爆炸的致命竞赛中——AI创造更强AI的能力正在逼近临界点,就像失控的核链式反应一样。放慢速度能给我们争取急需的时间,但没有任何参与者愿意单方面停下来。
Meta数据工程师Walker Smith表示,哈萨比斯说得对:我们今天正站在奇点的山脚下。OpenAI那次模型出逃是一个清晰而无可辩驳的警告信号:我们还没有准备好应对能力超越人类最聪明头脑的AI系统。我们需要时间,把AI对齐和管控作为最高优先事项来推进。
OpenAI的Brandon Houghton支持让人类保持对前沿AI的控制,但强调必须审慎思考。他担心如果治理只覆盖公开模型,就有可能把最先进的能力逼入私有或专用系统——这样做的结果是权力更集中了,风险却没有实质性降低。有效的监管必须是可衡量、可验证的,并且在公开和非公开的研发中一体适用。
Anthropic技术团队成员Joe Carlsmith则详细阐述了关于主动调控AI发展的观点。
