鼓狮财经9月2日讯,OpenAI周二宣布,其即将推出的下一代人工智能模型Astra,是首款突破“关键”网络安全能力阈值的产品。该公司表示,Astra能够发现此前未知的安全漏洞,并在无需人类指导的情况下加以利用,这使其属于OpenAI“准备框架”中最为先进的类别。
据业内透露,Astra被OpenAI定位为下一个主要人工智能模型。它不仅网络安全能力出色,还能支持多个智能体长期协同工作以解决复杂问题,例如调度智能体协同完成数学证明;此外,它还能直接操控桌面软件,处理PPT制作、财务审核及数据分析等复杂任务。
关于发布计划,OpenAI表示将“尽快”发布Astra,但网络安全功能的访问权限将受到更多限制。该模型初期执行高级网络安全相关任务的能力将仅限于部分测试人员。随后,公司将通过“Daybreak Blue”计划向更多用户开放访问权限,用于防御性网络安全工作。该计划允许经批准的测试人员使用其功能最强大的模型,并配合专为网络安全工作设计的安全措施。
考虑到Astra在网络安全任务方面展现出的显著能力,OpenAI曾在8月暂停部分内部研发工作,以便增添更严格的安全措施。这一举措也源于公司此前在7月对Hugging Face发起的意外攻击事件,该事件促使OpenAI加强了对模型失控风险的管控。
OpenAI周二进一步表示,已利用从该事件中吸取的经验,为Astra添加了更强大的防护机制。这些措施包括训练模型拒绝回应有害的网络请求,以及在内部部署期间监控是否存在未经授权的行为,并自动停止潜在风险。OpenAI认为,经过加强和测试,Astra模型的安全保障措施已充分降低了发布后可能带来的严重危害风险。
