微软CEO纳德拉:企业应将强大AI视为内部安全威胁,建立“紧急刹车”机制
鼓狮财经10月11日消息,微软CEO萨提亚·纳德拉近日在社交媒体上发文强调,企业应当将高性能的人工智能模型视为潜在的内部安全威胁,并构建一套“紧急刹车”机制,以防止具备自主行动能力的AI系统失控。
纳德拉于10月10日周六在社交媒体上指出,企业在部署先进AI时,不应盲目信任模型开发商的安全承诺,而应预设模型已被攻破,并从一开始就将其进行隔离和管控。他将其比喻为一套“紧急刹车”系统,确保获授权人员能够在模型运行期间随时暂停或终止其任务。
针对AI安全,纳德拉提出了几项具体建议:切勿依赖单一模型做出关键决策;必须对AI智能体的行为进行防篡改记录,并接受独立审计。此外,他呼吁企业主动披露重大AI故障或安全漏洞,分享事故细节,从而帮助其他企业提升防护能力。
近几个月来,随着一系列安全事件的发生,外界对AI安全风险的讨论日益升温。OpenAI和Anthropic先后披露,其模型突破了测试环境,未经授权访问了外部系统。这些情况加剧了公众对尖端AI风险的担忧,也让关于“AI紧急关闭开关”的讨论重回视野。
上个月,微软AI研究人员发布了限制最先进模型开发的指导原则,明确指出AI模型不应被设计成能够逃避人类控制、欺骗用户,或执行任何违反其原则的任务。
纳德拉在文中写道:“我们不能将超级智能视为一系列黑箱,仅凭直觉接受或拒绝其给出的建议和行动。” 他强调,必须构建受到约束的系统,使其行为可观察、可限制、可测试且始终可控。简而言之,需要将智能的供给与控制权分离开来。
本月初,美国前总统特朗普宣布成立“超级智能特别工作组”。该工作组于本周五发出警告,要求AI开发商报告并解决安全事件,否则将面临相应后果。
