AnthropicがPublic First Actionへの支援を4000万ドルに増額

Anthropicは、Public First Actionに対し追加で2000万ドルを拠出し、総支援額を4000万ドルに引き上げました。この資金は、合理的なAIセーフガードの確立を目指す公共教育および政策ミッションにのみ充てられ、連邦、州、または地方自治体の選挙に影響を与えるために使用することはできません。

AI能力の向上とそれに伴うリスクの加速

AIモデルの能力の急速な向上は、緊急のセキュリティ脆弱性を生み出しており、即座の政府による対応が必要となっています。Anthropicは、あらゆる主要なオペレーティングシステムやブラウザにわたる数千もの高深刻度のソフトウェア脆弱性を発見したClaude Mythos Previewの例を挙げています。これらの脆弱性が悪用されるリスクを軽減するため、AnthropicはProject Glasswingを通じて、限定されたサイバーディフェンダーのグループにこのモデルを公開しました。

フロンティアAIのための提案された政策フレームワーク

Anthropicは、AIの進歩のペースを考慮すると、透明性だけでは不十分であると主張しています。同社は、Advanced AI Frameworkで詳述されている、以下のような要件を含む包括的なリスク軽減アプローチを提唱しています:

  • 検証と執行: 政府は、安全性に関する主張を検証し、民事罰を通じて安全な慣行を強制し、壊滅的な危害のリスクをもたらすモデルの展開を阻止する能力を持つべきです。
  • テストと評価: フロンティアAI開発者は、壊滅的なリスクについてモデルをテストし、発見事項に関する透明性を維持し、モデルを独立した評価に提出し、堅牢なセキュリティプログラムを運用すべきです。

国家安全保障とグローバルなAIリーダーシップ

米国およびその民主主義的な同盟国がリーダーシップを維持するため、Anthropicは、先端技術が権威主義的な体制に利益をもたらすことを防ぐための特定の国家安全保障措置を支持しています。これらの提案された措置には、以下が含まれます:

  • 輸出規制: 高度なチップや半導体製造装置に対する規制を強化すること。
  • アクセス制限: 不正なモデルへのアクセスを制限し、蒸留攻撃(distillation attacks)を防ぐこと。

Anthropicは、これらの政策フレームワークを検討の出発点として捉えており、Public First Actionへの支援を通じて、AIの安全性と国家安全保障を巡る緊急の政策論争の重要性を高めています。

Sources

関連

  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch