OpenAI发布了一系列针对前沿人工智能开发的安全保障提案,核心聚焦于对齐研究与一种名为递归自我改进(RSI)的计算技术。该公司在一篇博客文章中表示,要安全完成这一转型,需要开展协调研究以跟上能力发展步伐,使各方构建的系统始终与人类价值观保持一致并处于人类控制之下。

在具体路径上,OpenAI呼吁开展国际合作、制定前沿标准,并建议借鉴全球现有AI安全机构的工作成果,其中包括美国商务部下属的AI标准与创新中心(CAISI)。该机构协助测试AI模型并制定相关指引。OpenAI还提出,这些技术标准应侧重于前沿AI模型与开发者,以及自动化AI研究人员的收益-风险管理,其中就涵盖RSI。

所谓RSI,是指AI系统能够在无人干预的情况下设计和开发其后续版本。尽管这一技术目前尚未实现,但随着AI系统在互联网上日益复杂和普遍,基础模型构建者可能面临失去对底层技术控制的风险,或未能预见潜在的意外后果。OpenAI在博客文章中明确表示,完全自主的RSI目前还无法实现,除非能够安全实现,否则不应贸然推进;如果缺乏适当的谨慎和保障,RSI可能导致人类失去对AI开发的实际控制权,无法对不再理解的研究过程进行监督。包括Anthropic和OpenAI在内的多家公司此前也警告称,这将使人类更容易失去对这些系统的控制。

OpenAI在文章中还提到了“抱抱脸(Hugging Face)事件”。该攻击虽不涉及RSI技术,但OpenAI将其视为一种“预览”——如果没有强有力的保障措施和协调,某些风险可能会变得更加严重。

这一提案的发布并非孤立事件。上周,竞争对手Anthropic也提出了自己关于前沿AI模型安全开发的构想,这是对近期热门研究人员纷纷就AI对人类威胁发出警告的回应。曾先后在Anthropic和OpenAI两家公司任职的Jacob Coxon近两周前宣布辞职,并称这些公司“拿我们的生命冒险”,此举引发了全球热议。

随后,Anthropic首席执行官达里奥·阿莫代伊(Dario Amodei)发表了一篇长篇博文,将讨论推向白热化。他呼吁业界放慢脚步,并表示这项工作需要行业和全球的协调配合。这一表态立即得到了OpenAI首席执行官萨姆·奥尔特曼埃隆·马斯克的支持。阿莫代伊还提出了在公司内部引入第三方评估人员的想法,以此来审核和减轻其技术可能对社会造成的潜在风险,例如加剧网络安全相关的黑客攻击或制造生物武器。

不过,由于AI评估领域尚处于起步阶段,对于允许独立第三方更彻底地检查尖端技术的基本标准和原则,业界尚未达成统一共识。OpenAI此次提案的发布,正值全球AI安全监管讨论升温之际,其能否推动形成具有约束力的国际标准,仍有待观察。