OpenAI Framework for AI Safety Cooperation
OpenAIは、競争圧力が原因で企業が安全性への投資を過小に行うという「集団的行動問題」を招かないよう、AIの安全性に関する規範における長期的な業界協力の改善に向けた4つの主要な戦略を特定しました。AIシステムがますます強力になるにつれ、それらが安全で有益であり続けることを確実にするために、この協力は不可欠です。
Four Strategies for Improving AI Safety Cooperation
安全性基準の遵守の可能性を高めるために、OpenAIは以下の4つの実行可能な戦略を提案しています。
1. Promoting Accurate Beliefs About Cooperation
業界のプレーヤーは、AIに関連する安全性およびセキュリティのリスクについてコミュニケーションを取り、共通の懸念事項を共通知識(common knowledge)とすべきです。協力を促進するために具体的なステップが取れることを示すことで、企業は相互利益の機会に関する認識を一致させることができます。
2. Collaborating on Shared Research and Engineering
企業は、補完的な専門知識を組み合わせた、学際的な共同研究に従事すべきです。このコラボレーションは、その解決策が分野全体に広い有用性を提供する研究およびエンジニアリングの課題に焦点を当てた場合に、特に効果的です。
3. Increasing Transparency and Oversight
OpenAIは、AI開発のより多くの側面を適切な監視とフィードバックに開放することを提案しています。これには、行動規範の公表、出版に関連する意思決定に関する透明性の向上、および知的財産やセキュリティ上の懸念に対処することを条件として、個々のAIシステムを精査できるようにすることが含まれます。
4. Incentivizing High Safety Standards
業界は、安全性基準を遵守するための経済的、法的、または業界全体のインセンティブをサポートすべきです。これには、これらの基準に従う組織を称賛し、システムが安全に開発されることを確実にできない組織を非難することが含まれます。
Addressing the Collective Action Problem
AI業界における競争圧力は、「集団的行動問題」を引き起こす可能性があります。これは、競争上の優位性を得るために安全性規範から逸脱するインセンティブが、協力するインセンティブを上回ってしまう状況を指します。OpenAIは、AIの失敗や悪用を防ぐといった、安全な開発による相互利益が、安全性を無視することによって得られる利点よりも高い場合に、協力の可能性が高まると主張しています。
安全策を無視する誘惑を減らすために、OpenAIは以下を提案しています:
- Reducing implementation costs: 安全策の実施コストを下げ、実施の難易度を下げることで、コンプライアンスをより魅力的なものにします。
- Regulatory environments: 政府は、重大な安全性基準の違反を禁止する規制環境を構築できます。
Proposed Areas for Collaborative Research
OpenAIは、組織や国家の境界を越えたコラボレーションの徹底的なマッピングを提唱しており、特に以下のような広い有用性を持つ領域に焦点を当てています:
- Formal verification: AIシステムの能力やその他の安全性およびセキュリティの側面に関する形式的な検証の共同研究。
- AI for good: 持続可能性や健康などの、広範なポジティブな応用が期待できるドメインにおける応用プロジェクト。
- AI countermeasures: オンラインにおける合成メディア生成の悪用といった、グローバルな脅威に対する対抗策の共同開発。