OpenAI、AIの悪意ある使用を阻止するレポート(2025年6月)

OpenAIは、AI駆動の調査ツールを活用して、隠密影響作戦、サイバー諜報、ソーシャルエンジニアリングなどの悪意ある活動を検出・阻止しています。このアプローチは、専門チームの戦力倍増装置として機能し、虐待的な活動の特定と露呈をより効率的に可能にします。

AI安全性とガバナンスの戦略的枠組み

OpenAIは、常識的なルールと民主的AIの開発を通じて人々を実際の危害から守ることを最優先とする枠組みの下で運営しています。この戦略は、権威主義的政権がAIツールを権力の集中、国民の統制、あるいは他国への強要に利用することを防止することに焦点を当てています。

AIの悪用防止に重点を置く主な領域は次のとおりです:

  • 隠密影響作戦(IO)
  • 児童搾取
  • 詐欺とスパム
  • 悪意あるサイバー活動

最近の阻止事例とケーススタディ

2025年6月のレポートの直前の3か月間に、OpenAIの調査チームはAIを用いて複数の虐待活動のカテゴリを検出・露呈しました。防御メカニズムにAIを統合することで、同組織は以下の活動を成功裏に阻止しています:

  • 隠密影響作戦: 世論操作を目的とした欺瞞的なキャンペーンを特定。
  • サイバー諜報: AIを用いた不正なデータアクセスや情報収集の試みを検出。
  • ソーシャルエンジニアリング: ユーザーを欺く心理的操作に依存する攻撃を防止。
  • 欺瞞的な雇用スキーム: 詐欺やデータ窃盗の手段として利用される偽の求人情報を露呈。
  • 一般的な詐欺: AIを利用したさまざまな詐欺活動を阻止。

米国AIアクションプランとの整合性

これらの取り組みは、OpenAIが3月に科学技術政策局(OSTP)へ提出した米国AIアクションプランと一致しています。同組織は、AIが人類に利益をもたらすためには、危害を防止するルールの実施と、体系的な悪用に対抗する者を支援するAIツールの展開という二重のアプローチが必要であると主張しています。

Sources