OpenAI 前沿治理框架

OpenAI 已发布前沿治理框架,这是一份公共治理文件,旨在使公司内部的安全和安保实践与新兴的全球法律要求保持一致。该框架确保 OpenAI 在管理先进 AI 风险方面的运营方法满足特定的监管义务,包括欧盟《人工智能法案》通用人工智能实践守则和加州《前沿人工智能透明度法案》。

与监管要求的一致性

前沿治理框架充当 OpenAI 内部安全协议与外部法律要求之间的桥梁。虽然公司继续使用其准备框架作为定义和实施重大风险管理的基础——包括超出当前法律要求的做法——但前沿治理框架专门将这些方法转化为面向公众的、聚焦监管合规的文件。

风险评估与缓解的范围

该框架在多个高风险领域建立了结构化的风险评估与缓解流程。重点关注的关键领域包括:

  • 网络攻击: 管理与 AI 在网络攻击中使用相关的风险。
  • CBRN 风险: 处理与化学、生物、放射性和核威胁相关的风险。
  • 有害操纵: 减轻 AI 被用于欺骗或有害操纵的潜在风险。
  • 失控风险: 管理 AI 系统可能表现出人类操作员无法再控制的行为的风险。

除这些特定风险领域外,框架还概述了模型报告、安全风险管理、事件响应、外部专家意见的整合以及框架更新流程的协议。

演进与维护

OpenAI 表示,前沿治理框架并非静态的。公司预计该方法将随以下三大驱动因素同步演进:

  1. 模型能力: 随着 AI 系统变得更强大,新的风险和缓解策略将出现。
  2. 评估: 对 AI 安全和安保测量方式的改进将为框架更新提供信息。
  3. 监管要求: 随着新法律的通过和现有法律的澄清,框架将更新以保持合规。

Sources