OpenAI 前沿 AI 監管提案

OpenAI 與一組多學科研究人員提出一個監管框架,用於管理前沿 AI 模型的公共安全風險,透過標準制定、註冊和合規機制。

前沿 AI 的監管挑戰

前沿 AI 模型呈現三個不同的挑戰,使得傳統監督變得困難:

  • 意外出現: 危險能力可能在模型中意外產生,使得在開發之前無法預測所有風險。
  • 濫用潛力: 模型部署後,難以強有力地阻止用戶將其用於有害目的。
  • 擴散: 一旦發布,前沿模型的能力廣泛擴散難以阻止。

提議的監管構建塊

為了應對這些風險,作者提出三個主要的監管構建塊:

  1. 標準制定流程: 建立正式流程以識別和定義前沿 AI 開發者適用的適當安全與保安需求。
  2. 註冊與報告: 實施要求,讓開發者註冊其模型並報告其開發過程,以便監管者獲得必要的可見性。
  3. 合規機制: 建立系統,確保開發者在開發與部署兩個階段都遵守既定的安全標準。

治理與執行選項

雖然業界自律被視為必要的第一步,但作者指出政府介入是創建具約束力標準並確保合規所必需的。執行的建議選項包括:

  • 監管機構: 賦予專門監管機構執行權力。
  • 許可制度: 為前沿 AI 模型的開發與部署實施許可要求。

前沿 AI 的初步安全標準

該提案概述了一套初步的安全標準,開發者應該遵循以降低風險:

  • 部署前風險評估: 在模型發布前進行潛在風險的徹底評估。
  • 外部審查: 將模型行為提交給外部審查與分析。
  • 外部風險知情部署: 使用風險評估結果直接資訊並指導部署決策。
  • 部署後監控: 在模型部署後持續監控並回應有關模型能力與使用的新資訊。

Sources