フロンティアモデルフォーラム アップデート

OpenAI、Anthropic、Google、およびMicrosoftは、Chris Meseroleをフロンティアモデルフォーラムの初代エグゼクティブディレクターに任命し、$10 millionのAIセーフティファンドを立ち上げました。これらのイニシアティブは、リーダーシップ、独立した研究資金、業界全体の技術標準の確立を通じて、フロンティアAIモデルの安全かつ責任ある開発を確保することを目的としています。

エグゼクティブディレクターの任命

Chris Meseroleは、ブルッキングス研究所の人工知能および新興技術イニシアティブのディレクターを務めた後、フロンティアモデルフォーラムの初代エグゼクティブディレクターに任命されました。この役割において、Meseroleはフォーラムの使命をリードする責任があります:

  • AIセーフティ研究を推進し、潜在的なリスクを最小限に抑え、責任ある開発を促進します。
  • フロンティアモデルの安全ベストプラクティスを特定し、確立します。
  • 学術関係者、政策立案者、市民社会との知識共有を促進します。
  • 社会的課題に対処するためのAIの利用を支援します。

AIセーフティファンド

AIの能力が加速する中で学術研究のギャップに対処するため、フロンティアモデルフォーラムといくつかの philanthropic パートナーは、新しいAIセーフティファンドのために初期資金として$10 million以上を拠出することに合意しました。

資金源と管理

このファンドは、Anthropic、Google、Microsoft、OpenAI、およびPatrick J. McGovern Foundation、David and Lucile Packard Foundation、Eric Schmidt、Jaan Tallinnなどの philanthropic パートナーによって支援されます。ファンドはMeridian Instituteによって管理され、独立した外部専門家、AI企業の代表者、助成金の専門家からなる諮問委員会によって監督されます。

目的と範囲

AIセーフティファンドの主な焦点は、学術機関、研究センター、スタートアップからの独立した研究者を支援することです。このファンドは、フロンティアシステムにおける潜在的に危険な能力をテストするための新しいモデル評価とレッドチームング技術の開発を特に対象とします。このイニシアティブは、2023年初頭にホワイトハウスで署名された自発的なAIコミットメントの一部を満たし、第三者による脆弱性の発見と報告を容易にすることを目的としています。

技術標準とレッドチームング

フロンティアモデルフォーラムは、研究者、政府、業界の同僚間の議論を同期させるため、定義とプロセスの共通ベースラインを確立しようとしています。

レッドチームングの標準化

フォーラムは、AIのための「レッドチームング」の共通定義を提供する最初のテクニカルワーキンググループのアップデートをリリースしました。フォーラムは、レッドチームングを「有害な能力、出力、またはインフラストラクチャの脅威を特定するために、AIシステムと製品を調査する構造化されたプロセス」と定義しています。

責任ある開示プロセス

フォーラムは、フロンティアAIラボが発見した脆弱性、危険な能力、および関連する緩和策に関する情報を共有できるように、責任ある開示プロセスを開発しています。このプロセスは、フォーラムメンバーが国家安全保障の領域で行ったAIの能力と緩和策に関する既存の研究に基づいています。

未来のロードマップ

フロンティアモデルフォーラムは、戦略と優先順位をガイドする諮問委員会を設置します。今後のマイルストーンには、AIセーフティファンドのための最初の提案募集の発行と、利用可能になるに従ってさらなる技術的知見のリリースが含まれます。

Sources