OpenAI AI Policy Proposal and Safety Framework
OpenAIは、AI能力の急速な進歩により、自発的な取り組みから民主的な監視への移行が必要であると主張し、米国における能力ベースの義務的な国家AI安全性規制の戦略的な推進を発表しました。同社は、AI能力がそれらを統治する機関を追い越してしまう前に、永続的なセーフガードを確立するための「政策の窓」が現在開いていると主張しています。
Mandatory National AI Safety Requirements
OpenAIは、米国議会に対し、能力ベースで進化可能な義務的な国家AI安全性規制を導入することを提唱しています。提案されているフレームワークは、以下の主要な領域に焦点を当てています:
- Targeted Application: 安全性要件は、スタートアップや小規模な研究者ではなく、最も有能なフロンティア・システムを開発している、リソースの豊富な少数の研究所に具体的に適用されるべきです。
- Federal Framework Components: OpenAIの「Blueprint for Democratic Governance of Frontier AI」に基づき、同社は、共通のテスト、独立した評価要件、より強力なサイバーセキュリティ保護、明確なインシデント報告ルール、および再帰的自己改善に向けた進捗を追跡するための共有策を求めています。
- Balance of Open and Closed Models: OpenAIは、アメリカのリーダーシップにとってオープンモデルとクローズドモデルの両方が必要であり、連邦政府のフレームワークは、競争を抑制したりイノベーションを海外へ流出させたりすることなく、フロンティア・リスクに対処すべきであると主張しています。
- Governance Shift: 目標は、研究所が独自のルールを設定する断片化された民間ガバナンスのシステムを、民主的に説明責任のある標準と独立した検証に置き換えることです。
Support for California State Legislation
連邦政府の行動を待つ間、OpenAIは、州レベルの立法が、最終的に議会が法典化するための事実上の国家基準となる「逆フェデラリズム」の戦略を支持しています。OpenAIは、カリフォルニア州の4つの法案を正式に支持しています:
- SB 813: AIリスクを評価するための、資格のある独立した組織を指定するプロセスを確立します。
- AB 1405: AI監査人に対する登録、独立性、透明性、および説明責任の要件を創設します。
- SB 1119: 青少年の安全に焦点を当て、コンパニオン・チャットボットに対する年齢確認、リスク評価、独立した監査、および保護者の管理を要求します。
- AB 1864: 遺伝子合成プロバイダーおよびベンチトップ合成装置の製造業者が、AIによる生物学的脅威を防ぐために連邦政府のスクリーニング基準に従うことを要求します。
Recursive Self-Improvement and Research Acceleration
OpenAIは、完全に自律的な再帰的自己改善(AIが次世代のより有能なAIを独立して駆動するプロセス)は、現在発生していないと述べています。しかし、同社は、AIが次世代モデルの開発とアライメントのための研究の一部をすでに加速させていることに言及しています。
これを管理するため、OpenAIは、単なる能力の成長よりも安全性とアライメントを優先するために、人間の監督下で自動化されたAI研究者を構築することを目指しています。同社は、政府が、開発を遅らせるか停止させるべきタイミングを決定する共有の安全性基準を確立し、能力の成長と安全性が衝突する場合、安全性を能力の成長よりも優先させることを提唱しています。
Industry Standards and Monitoring
OpenAIは、義務的な連邦政府のセーフガードを補完するために、業界主導の標準を求めており、モデルが人間の意図に反する方法で目的を追求する「misalignment(不整合)」の監視に特に焦点を当てています。
主な監視および開示の提案には、以下が含まれます:
- Security Breach Notification: モデルが保護されたシステムにアクセスまたは変更するためにセキュリティ・コントロールを回避した場合、企業は速やかに書面による通知を提供すべきです。
- Incident Reporting: OpenAIは、重大なAIインシデントに関する連邦政府の報告要件を支持しており、重大な不整合(misalignment)インシデントの報告のための独自のフレームワークを開発しています。
- International Coordination: OpenAIは、AI研究と失敗が世界的な影響を及ぼす可能性があるため、能力の測定とリスク管理のための互換性のある国際標準が不可欠であると主張しています。
Internal Safety Measures
OpenAIは、モデル開発ライフサイクル全体にわたり、いくつかの内部セーフガードを実装しています。これには以下が含まれます:
- Isolation: フロンティア研究ワークロードに対する、より強力な隔離。
- Behavioral Monitoring: ツール使用可能なトレーニングおよび評価中のモデルの挙動の監視の拡大。
- Astra-Specific Safeguards: Astraモデルについては、OpenAIは、フル・トラジェクタリ(思考の連鎖を含む)のユニバーサル・モニタリングと、内部展開前の義務的なアライメント評価ゲートを導入しました。