OpenAI AI ガバナンス コミットメント
OpenAI は、安全性、透明性、およびフロンティア AI システムの責任ある開発に焦点を当て、AI ガバナンスを前進させるための自発的なコミットメントのセットにコミットしています。これらのコミットメントは、レッドチーム、業界間の情報共有、AI 生成コンテンツの識別、およびモデルの制限に関する公開報告に焦点を当てています。
包括的なレッドチームと安全性評価
OpenAI は、スコープ内の新しいモデルのすべての主要な公開リリースに対して、内部および外部のレッドチームを実施することを約束します。このプロセスでは、独立したドメインエキスパートを活用して、システムの悪用、社会的リスク、および国家安全保障上の懸念を評価します。
レッドチームの焦点となる具体的な分野には以下が含まれます:
- 生物学的、化学的、および放射線リスク: システムが兵器の開発、設計、取得、または使用への参入障壁をどのように低減するかを評価します。
- サイバー能力: システムが脆弱性の発見、悪用、または運用使用にどのように役立つかを評価し、これらの能力が防御目的にも使用できることに注意します。
- システム相互作用とツール使用: モデルが物理システムを制御する能力を分析します。
- 自己複製: モデルが自分自身のコピーを作成する能力を評価します。
- 社会的リスク: バイアスと差別に対処します。
これらの取り組みを支援するため、OpenAI は AI の安全性に関する研究を進めており、特に意思決定プロセスの解釈可能性と悪用に対するシステムの堅牢性に焦点を当てています。これらの安全手順は、透明性レポートで開示されます。
情報共有と標準設定
OpenAI は、信頼と安全リスク、危険または新たな能力、およびセーフガードを回避しようとする試みに関して、企業および政府間での情報共有に向けて取り組みます。これには、NIST AI リスク管理フレームワークなどの共有規格およびベストプラクティスを開発・採用するためのフォーラムの設立または参加が含まれます。
これらのメカニズムは、フロンティア能力と新たな脅威に関する情報の共有を促進し、政府、市民社会、および学術界の関与を通じて、懸念の優先分野に関する技術ワーキンググループを開発します。
AI 生成コンテンツの識別
ユーザーが人間が生成したコンテンツと AI が生成したコンテンツを区別できるようにするため、OpenAI は公開されているシステムによって作成される音声および視覚コンテンツに対して堅牢なメカニズムを開発することを約束します。これには、出所およびウォーターマークシステムの使用が含まれます。
この実装の主な詳細には以下が含まれます:
- スコープ: ウォーターマークシステムが開発された後に導入される音声または視覚コンテンツに適用されます。
- ツール: そのシステムによってコンテンツが作成されたかどうかを判断する API またはツールの開発。
- 除外: 現実と容易に区別できるコンテンツ(例:デフォルトの AI アシスタント音声)はスコープ外です。
- データ: ウォーターマークまたは出所データにはモデルまたはサービス識別子が含まれますが、ユーザーを特定する情報は含まれません。
OpenAI はまた、業界の同業者および標準設定機関と協力して、AI 生成コンテンツとユーザー生成コンテンツを区別するための技術フレームワークを開発することを誓約します。
透明性と公開報告
OpenAI は、スコープ内のすべての新しい重要なモデルの公開リリースについて、報告書を公開することを約束します。これらの報告書には以下の詳細が含まれます:
- 安全性評価: 危険な機能を含む安全性評価の結果。これらは公開責任がある場合に限り公開されます。
- パフォーマンスの制限: 適切な使用ドメインに影響を与えるパフォーマンスの重大な制限。
- 適切な使用: 適切および不適切な使用ドメイン。
- 社会的リスク: モデルの公平性とバイアスへの影響についての議論。
- 敵対的テスト: モデルの導入適合性を評価するための敵対的テストの結果。
社会的リスクの軽減とグローバルな課題
OpenAI は、有害なバイアスと差別の回避およびプライバシーの保護を含む社会的リスクの研究を優先します。これには、信頼と安全チームのエンパワーメントおよび子供の保護を通じて、AI リスクを積極的に管理することが含まれます。
さらに、OpenAI は、以下のようなグローバルな課題に対処するため、フロンティア AI システムの研究開発を支援することに同意します。
- 気候変動の緩和と適応。
- 早期のがん検出と予防。
- サイバーセキュリティ: サイバー脅威への対抗。
OpenAI はまた、学生と労働者が AI から繁栄し、市民がテクノロジーの影響を理解できるよう、教育およびトレーニングイニシアティブを支援することにもコミットしています。
Sources
- OriginalMoving AI governance forward