OpenAI 前沿治理框架

OpenAI 前沿治理框架

OpenAI 已發布前沿治理框架,這是一份公共治理文件,旨在使公司內部的安全與保安實踐與新興的全球法律要求保持一致。此框架確保 OpenAI 在管理先進 AI 風險的運營方式符合特定的監管義務,包括《歐盟人工智慧法案》針對通用人工智慧的實務守則以及加州《前沿人工智慧透明法案》。

與監管要求的對齊

前沿治理框架充當 OpenAI 內部安全協議與外部法律規範之間的橋樑。儘管公司仍持續以其備援框架作為定義與落實重大風險管理的基礎——包括超出現行法律要求的做法——前沿治理框架則專門將這些方法轉化為面向公眾的文件,聚焦於監管合規。

風險評估與緩解的範圍

此框架在多個高風險領域建立了結構化的風險評估與緩解流程。主要關注領域包括:

  • 網路攻擊: 管理與 AI 在網路攻擊中使用相關的風險。
  • CBRN 風險: 處理與化學、生物、放射及核威脅相關的風險。
  • 有害操控: 減輕 AI 被用於欺騙或有害操控的潛在風險。
  • 失控: 管理 AI 系統可能以人類操作員無法再控制的方式行為的風險。

除上述特定風險領域外,框架亦概述了模型報告、安全風險管理、事件回應、外部專家意見的整合以及框架更新的流程。

演進與維護

OpenAI 表示前沿治理框架並非靜態。公司預期此方法會隨三大主要驅動因素同步演進:

  1. 模型能力: 隨著 AI 系統變得更強大,將出現新的風險與緩解策略。
  2. 評估: 對 AI 安全與保安測量方式的改進將為框架更新提供資訊。
  3. 監管要求: 隨著新法律的通過與現行法律的澄清,框架將更新以維持合規。

Sources