Anthropic Frontier Compliance Framework for California SB 53

Anthropicは、1月1日に施行されるカリフォルニア州のTransparency in Frontier AI Act (SB 53) に準拠するため、Frontier Compliance Framework (FCF) を公開しました。このフレームワークは、同社がフロンティアAIモデルに関連する壊滅的なリスクをどのように評価し、管理するかについての公開基準を確立するものです。

Frontier Compliance Framework (FCF) Overview

Frontier Compliance Framework (FCF) は、AnthropicがSB 53の法的要件を満たすために使用する主要な文書です。これには、以下のような特定の重大なリスクを評価および軽減するための同社のプロセスが詳細に記載されています:

  • Catastrophic Threats: FCFは、サイバー攻撃、化学、生物、放射性、および核(CBRN)の脅威、ならびにAIのサボタージュや制御不能に関連するリスクをカバーしています。
  • Capability Evaluation: このフレームワークは、これらのリスクカテゴリに対してモデルの能力を評価するために、階層化されたシステムを利用しています。
  • Operational Security: FCFは、モデルの重みを保護し、安全上のインシデントに対応するためのアプローチの概要を示しています。

Relationship Between FCF and Responsible Scaling Policy (RSP)

FCFはSB 53およびその他の規制要件を満たすための義務的なコンプライアンス文書ですが、AnthropicのResponsible Scaling Policy (RSP) とは異なります。RSPは、同社の内部的なベストプラクティスを反映し、AIの状況の変化に応じて進化する、自発的な安全ポリシーであり、現在の規制上の義務を上回る可能性があります。

Advocacy for Federal AI Transparency Standards

Anthropicは、SB 53のような立法を通じて透明性の慣行を形式化することで、競争が激化したりモデルの能力が向上したりしても、安全へのコミットメントが放棄されないことを保証できると主張しています。しかし、同社は、国家的な一貫性を確保するために連邦基準を提唱しています。

彼らが提案する連邦フレームワークには、5つの核心的な原則が含まれています:

  1. Public Secure Development Frameworks: 開発者は、CBRNの危害や不整合なモデルの自律性を含む、重大なリスクをどのように評価し軽減するかを公開しなければなりません。
  2. Deployment System Cards: デプロイメント時に、テスト、評価手順、結果、および軽減策をまとめた公開文書を公開し、大幅な変更があった場合には更新しなければなりません。
  3. Whistleblower Protections: コンプライアンスについて嘘をついたり、違反を報告する従業員を罰したりすることは違法でなければなりません。
  4. Flexible Transparency Standards: 要件は、AI開発の進化する性質に対応できるよう、軽量で適応可能なものであるべきです。
  5. Targeted Application: 小規模なスタートアップや低リスクのモデルに負担をかけないよう、規制は最大のフロンティア開発者にのみ適用されるべきです。

Compliance Context

SB 53は、米国における壊滅的なリスクに対する最初のフロンティアAIの安全性と透明性の要件を確立するものです。Anthropicは、安全性の慣行、インシデント報告、および内部告発者保護と、実施における柔軟性および小規模企業への免除とのバランスが取れているとして、この法律を支持しました。

Sources

関連

  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch