OpenAI 安全與保安實踐更新

OpenAI 已將其安全與保安委員會(SSC)轉變為獨立的董事會監督委員會,以治理模型開發與部署期間的關鍵安全與保安措施。此舉建立了一套正式的機制,對模型發布進行獨立監督,並包括在安全問題得到解決前延遲發布的權限。

獨立治理與董事會監督

安全與保安委員會現在將作為獨立的董事會監督委員會運作。委員會由卡內基梅隆大學機器學習系主任 Zico Kolter 主持,成員包括 Quora 執行長 Adam D’Angelo、退休的美國陸軍將軍 Paul Nakasone,以及前索尼公司執行副總裁兼總法律顧問 Nicole Seligman。

Key responsibilities of the committee include:

  • 模型發布監督:委員會與全體董事會對模型發布進行監督。如果安全問題未解決,他們有權延遲發布。
  • 技術簡報:公司領導層向委員會提供主要模型發布的安全評估。委員會定期收到關於當前與未來模型的技術評估以及發布後監測的報告。
  • 營運參與:委員會與 OpenAI 內部的安全與保安團隊保持定期互動。

加強的網路安全措施

OpenAI 正採用基於風險的網路安全方法,以保護先進的 AI 研究與產品基礎設施。目前的倡議包括:

  • 基礎設施安全:擴大內部資訊分割,並增加全天候安全運營團隊的人員配置。
  • 產業合作:評估為 AI 產業建立資訊共享與分析中心(ISAC),以促進 AI 實體之間的威脅情報與網路安全資訊共享。

透明度與外部合作

OpenAI 正透過以下管道擴大其透明度努力與第三方對安全系統的驗證:

透明度報告

OpenAI 持續為其模型發布系統卡,例如 GPT-4o 與 o1-preview,卡片詳細說明了功能、風險、外部紅隊測試結果,以及在備援框架下進行的前沿風險評估。

外部合作夥伴

  • 獨立測試:公司正與非政府實驗室及第三方安全組織建立合作,以進行獨立的模型安全評估。
  • 政府合作:OpenAI 正與美國與英國的 AI 安全研究所合作,研究新興風險與可信 AI 的標準。亦與洛斯阿拉莫斯國家實驗室合作,研究 AI 在生物科學研究環境中的安全使用。

統一的開發安全框架

OpenAI 正實施一套整合的安全與保安框架,為模型發布設定明確的成功標準。此框架基於風險評估,且必須經安全與保安委員會批准。

為支援此框架,OpenAI 已重新組織其研究、安全與政策團隊,以確保組織內更緊密的協作與更強的連結。此框架旨在隨著模型能力與複雜度的提升而調整。

Sources