OpenAI 为人工智能下一阶段制定建设标准

OpenAI 宣布了一项关于制定前沿人工智能开发全球技术标准的提案。该倡议旨在确保随着人工智能系统在自身研究和开发中变得更加自主——这一过程被称为递归自我改进(RSI)——它们仍与人类价值观保持一致并处于人类控制之下。

递归自我改进(RSI)与人工智能研究

自动化人工智能研究使人工智能系统能够承担部分开发下一代人工智能所需的工作。这一递归自我改进(RSI)过程在自动化程度提高后,可以迅速加速人工智能的进步。

OpenAI 指出 RSI 可能带来若干潜在益处与风险:

  • 益处: 自动化人工智能研究可降低高级智能的成本,提升人们的生活质量,并作为自动化的人工智能安全研究人员,以改善对齐性并构建针对强大人工智能的防御措施。
  • 风险: 完全自主的 RSI 可能导致人类失去对人工智能发展的实际控制,从而产生更危险且对齐性更差的系统。OpenAI 表示,除非能够安全地实施,否则不应追求完全自主的 RSI。

国际标准的必要性

OpenAI 认为,国际标准对于防止分裂、解决集体行动问题以及应对各国能力不均至关重要。若缺乏对高质量证据的共同定义以及技术防护措施的共识基准,就可能引发“逐底竞争”——各国独立行动,甚至忽视安全防护措施。

这些挑战适用于开放模型和封闭模型的开发者。OpenAI 强调,尽管实验室必须对安全负起个体责任,但国际标准为外部利益相关者提供了参与技术发展进程的途径。

全球标准的提议框架

OpenAI 建议由美国牵头,与其他国家合作制定这些全球技术标准。该提议框架包含两个主要组成部分:

1. 补充性国家与国际标准机制

OpenAI 建议利用现有的人工智能安全研究所网络(包括澳大利亚、加拿大、德国、法国、肯尼亚、日本、韩国、新加坡、印度和英国的机构)以及人工智能标准与创新中心(CAISI)。该努力将聚焦于前沿人工智能模型和开发者,依据能力基准进行衡量,并管理自动化人工智能研究中的收益与风险。

这些标准的关键特征包括:

  • 技术基础: 它们将为能力衡量、风险评估和防护充分性提供共同基础。
  • 非约束性: 这些标准不会成为许可或强制性的预发布审查。各国政府将自行决定如何将其纳入本国法律体系。
  • 包容性发展: 过程中应咨询开放模型和封闭模型开发者、学术界以及独立专家,以确保标准不会偏向特定公司或商业模式。

2. 共同测量标准与事件报告协议

为应对人工智能研究日益增强的自主性,OpenAI 提出以下标准:

  • RSI 相关进展的评估: 衡量公司内部自主研究的规模。
  • 人类监督: 明确哪些自动化研究流程应触发即时的人类审查。
  • 主权通信: 建立政府和关键基础设施运营商之间共享国家安全关切和新兴漏洞的安全渠道。

美国的战略定位

OpenAI 认为,控制人工智能发展节奏的关键在于确保对齐研究始终领先于能力发展。他们主张,美国在这一努力中具有独特优势,因为其人工智能产业处于技术前沿,并在全球金融、贸易和国防领域占据有利地位。领导这一进程使美国能够塑造全球人工智能框架,而非被动应对一个分裂且充满冲突的体系。

Sources