Anthropicによる米大統領令、G7行動規範、およびブレッチリー・パーク・サミットの分析

Anthropicは、2023年後半のAI政策における3つの極めて重要な出来事を特定しました。それは、包括的な米国のAIに関する大統領令の発令、G7国際行動規範の策定、そして英国主導のブレッチリー・パークにおけるAI安全性サミットです。これらの出来事は、フロンティアAIシステムの安全性、セキュリティ、および信頼性を評価・監視するための、グローバルで調整された取り組みへの移行を示唆しています。

米国のAIに関する大統領令

米国の行政命令(EO)は、プライバシー、公平性、バイアス、および壊滅的なリスクを含むAIのリスクに対処するための包括的な枠組みを確立すると同時に、最高AI責任者(Chief AI Officers)の任命を通じて、政府機関が公共サービス向上のためにAIを活用することを指示しています。

Anthropicは、EO内のいくつかの主要な技術的および構造的な指令を強調しています:

  • NISTの権限強化: EOは、国立標準技術研究所(NIST)に対し、モデルの能力と安全性に関する評価手法の開発、Secure Software Development Frameworkをフロンティアモデルにまで拡張すること、およびRisk Management Frameworkのための生成AIコンパニオンの作成を指示しています。
  • NAIRRパイロット: この命令は、National AI Research Resource (NAIRR) のパイロット版を開始します。これは、学術研究者がAI安全性研究や有益なアプリケーションの開発に必要なデータと計算リソースを提供することを目的として設計されています。

G7国際行動規範

広島プロセスを通じて策定された「高度なAIシステムを開発する組織のためのG7国際行動規範」は、AIのライフサイクル全体を通じてリスクを特定し、軽減するための責任ある実践方法のセットを提供します。

この規範は、以前のホワイトハウスによる自主的なコミットメントに基づいたものであり、以下の点に焦点を当てています:

  • リスク軽減: 評価、情報共有、ガバナンス、セキュリティ手順、および透明性措置の実装。
  • 規制のベースライン: Anthropicは、この規範を国際的なベストプラクティスおよび将来的な国内規制の潜在的なベースラインとして見ています。

ブレッチリー・パーク・サミットとブレッチリー宣言

英国政府のAI安全性サミットは、フロンティアAIに関する懸念に対処するため、世界の専門家や当局者を招集し、その結果としてブレッチリー宣言が作成されました。中国や発展途上国を含む28カ国が署名したこの声明は、AIのリスクと利益を管理するためのマルチステークホルダーによる行動を呼びかけています。

サミットの主な成果は以下の通りです:

  • 国際的な研究評価: 署名国は、科学の現状について政府に情報を提供するため、フロンティアAIの能力とリスクに関する既存の研究の国際的な評価を支援することに同意しました。
  • 責任あるスケーリング・ポリシー: サミット期間中、AnthropicのCEOであるDario Amodeiは、規制アプローチの潜在的なプロトタイプとして、同社のResponsible Scaling Policyを提示しましたが、これは正式な規制に代替わるものではありません。

政府によるAI安全性研究所の設立

最近の政策転換の主な成果は、AIモデルの技術的評価に特化した政府機関の設立です。

英国のAI安全性研究所

英国のFrontier AI Task Forceは、AI Safety Instituteとして再編されました。これは、フロンティアAIのリスクを評価することに焦点を当てた、最初の重要な政府の取り組みです。

この研究所は、Anthropicを含む研究所のフロンティアモデルに対して、すでに民間でのテストを実施している技術専門家を雇用しています。

米国のAI安全性イニシアチブ

米国は、NISTコンソーシアムを通じて、英国の研究所に相当する取り組みを開始しています。このイニシアチブは、以下の点に焦点を当てます:

  • 評価方法: AIシステムの安全性と信頼性を評価するための方法の開発。
  • Frontier Threats Red Teaming: NISTは、AIモデルにおける危険なデュアルユース(軍民両用)能力を特定するためのレッドチーミングのためのガイドラインを策定します。

評価科学の重要性

Anthropicは、評価科学を進展させ、独立したテストプロトコルを確立することが、賢明な規制を実現するための基礎的な要件であると主張しています。堅牢な測定能力があれば、政府はAIを効果的に監視することができ、リソースの少ない企業が、より大きな研究所との間で、同じ安全性ベンチマークに基づいて公平に競合することを可能にする客観的な枠組みを提供できます。

Sources

関連

  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch