鼓狮财经9月22日讯,当地时间周一,OpenAI发布了一系列关于前沿人工智能安全保障的提案,核心聚焦于“对齐研究”与“递归自我改进”(RSI)技术。OpenAI在博客中强调,要实现安全转型,必须开展协调研究,以匹配技术能力的提升,确保构建的系统始终与人类价值观保持一致,并处于人类掌控之中。
为此,OpenAI呼吁建立国际合作机制,制定前沿标准,并借鉴包括美国商务部下属AI标准与创新中心(CAISI)在内的全球现有安全机构经验,特别是关于AI模型测试与指引制定的成果。提案特别强调了针对自动化AI研究人员(如RSI)的收益风险管理。RSI是指AI系统能在无人干预下设计并开发后续版本。尽管该技术尚未成熟,但随着AI系统日益复杂,基础模型构建者可能面临失去控制或忽视潜在后果的风险。OpenAI警告称,若缺乏谨慎的保障措施,RSI可能导致人类失去对研发过程的监督。
博文中,OpenAI还提到了“抱抱脸”事件,指出尽管该攻击未涉及RSI,但若无强力保障,风险或将加剧。
这一动态源于上周竞争对手Anthropic的安全构想。此前,Anthropic前员工Jacob Coxon因担忧AI威胁生命而辞职,引发热议。Anthropic CEO达里奥·阿莫代伊随即发表长文,呼吁业界放慢节奏,强调需要全球协作。这一呼吁获得了OpenAI CEO萨姆·奥尔特曼和马斯克的支持。
此外,阿莫代伊提出引入第三方评估人员,审核技术潜在风险(如网络攻击、生物武器制造)。然而,目前AI评估领域尚处起步,关于独立第三方检查尖端技术的基本原则尚未达成共识。
