OpenAI が悪意のある AI の使用を妨害する

OpenAI は、その AI ツールの悪意のある使用を阻止するシステムを実装し、権威主義政権および国家関連の脅威アクターが AI を用いて権力を拡大し、他国を脅迫したり、秘密の影響工作を行うことを防ぐことに焦点を当てています。このアプローチは、常識的なルールを適用して実際の害から人々を保護することにより、人類に利益をもたらす人工一般知能を確保するという広範な使命の一部です。

悪意のある AI の使用を阻止するための技術的アプローチ

OpenAI の悪意のある AI の使用を阻止する戦略は、権威主義政権が市民をコントロールしたり他国を脅迫したりするために AI ツールを使用することを防ぐことに焦点を当てています。組織は、敵対的権威主義政権の対策に対して民主的な AI を保護するため、AI を活用した調査能力の使用を強調しています。

ターゲットとなる脅威カテゴリ

OpenAI は、AI ツールが促進する可能性のある高リスクの悪意のある活動の主要な分野をいくつか特定しています。これには以下が含まれます:

  • 秘密の影響工作 (IOs): 隠れた情報源を通じて世論を操作したり誤情報を拡散したりするために AI を使用することを防ぐ
  • 悪意のあるサイバー活動: 国家関連のアクターがサイバー攻撃を実行するために使用する可能性のある活動を阻止する
  • 秘密の影響工作 (IOs): 児童の搾取、詐欺、スパムを助長するために AI ツールの使用を防ぐ

コラボレーションと報告

OpenAI は、悪意のあるアクターへの対応を報告書として公開する慣習を確立しました。これは最初の AI 研究所による取り組みであり、この最新の報告書は AI を活用した作業の傾向と特徴を示し、阻止された脅威のケーススタディを提供しています。これらの報告書は、敵対者や悪意のあるアクターによる悪用を防ぐため、米国および同盟国の政府、業界パートナー、その他のステークホルダーが共有する同じ目標を支援することを意図しています。

Sources