Anthropic 針對加州 SB 53 的前沿合規框架

Anthropic 已發布其前沿合規框架 (Frontier Compliance Framework, FCF) 以符合加州《前沿 AI 透明度法案》(Transparency in Frontier AI Act, SB 53) 的要求,該法案將於 1 月 1 日生效。此框架為公司如何評估與管理與前沿 AI 模型相關的災難性風險建立了公開標準。

Frontier Compliance Framework (FCF) Overview

Frontier Compliance Framework (FCF) 是 Anthropic 用於滿足 SB 53 法律要求的首要文件。它詳細說明了公司評估與緩解特定高風險風險的流程,包括:

  • Catastrophic Threats: FCF 涵蓋了網路攻擊、化學、生物、放射性與核能 (CBRN) 威脅,以及與 AI 破壞和失去控制相關的風險。
  • Capability Evaluation: 該框架利用分層系統來根據這些風險類別評估模型能力。
  • Operational Security: FCF 概述了保護模型權重並對安全事件做出回應的方法。

Relationship Between FCF and Responsible Scaling Policy (RSP)

雖然 FCF 是滿足 SB 53 和其他監管要求的強制性合規文件,但它與 Anthropic 的負責任擴展政策 (Responsible Scaling Policy, RSP) 不同。RSP 仍是一項自願性安全政策,反映了公司的內部最佳實踐,並隨著 AI 領域的變化而演進,其內容可能超出目前的監管指令。

Advocacy for Federal AI Transparency Standards

Anthropic 主張,透過像 SB 53 這樣的立法將透明度實踐正式化,可以確保在競爭加劇或模型能力增長時,安全承諾不會被放棄。然而,該公司也倡導建立聯邦標準以確保全國一致性。

他們提出的聯邦框架包含五個核心原則:

  1. Public Secure Development Frameworks: 開發者必須發布他們如何評估與緩解嚴重風險(包括 CBRN 危害和模型自主性失調)的方法。
  2. Deployment System Cards: 在部署時必須披露總結測試、評估程序、結果和緩解措施的公開文件,並在進行重大修改時進行更新。
  3. Whistleblower Protections: 對合規性撒謊或懲罰舉報違規行為的員工必須是違法的。
  4. Flexible Transparency Standards: 要求應保持輕量化且具備適應性,以配合 AI 開發不斷演進的性質。
  5. Targeted Application: 監管應僅適用於最大的前沿開發者,以避免給小型初創公司和低風險模型帶來負擔。

Compliance Context

SB 53 為美國建立了首個針對災難性風險的前沿 AI 安全與透明度要求。Anthropic 支持該法案,因為它在安全實踐、事件報告和舉報者保護之間取得了平衡,同時在執行方面提供了靈活性,並對較小型公司提供了豁免。

Sources

相關

  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch