OpenAI が「Corrupt Comment」影響作戦を阻止

OpenAIは「Corrupt Comment」と呼ばれる影響作戦に関連する API アクティビティのクラスターを禁止しました。この作戦は OpenAI のモデルを使用して、X(旧 Twitter)上で英語のコメントを生成し、亡きアレクセイ・ナワルニーが設立した腐敗撲滅基金(FBK)とその指導部を批判しました。

作戦の仕組みと行動

「Corrupt Comment」作戦は OpenAI の API を利用して英語テキストを生成し、偽アカウントが X に投稿しました。これらのアカウントは主に腐敗撲滅基金の上層部とナワルニーの関係者を標的にしました。

  • 文脈認識の欠如: 生成されたコメントは既存の投稿(多くはロシア語で書かれた投稿)への返信として投稿されましたが、モデルがその投稿内容を読み取ったり、分析したり、適切な返信を生成したという証拠はありません。コメントは事前に生成されたもので、ソーシャルメディアのコンテンツに対してリアクティブではありません。
  • アカウントプロフィール: 関与した X アカウントは主に 2023 年 12 月に作成されました。これらのアカウントは通常フォロワーがゼロで、投稿への返信もゼロでした。
  • 視覚的欺瞞: これらのアカウントが使用したプロフィール画像は、インターネットからコピーした風景画像か、2019 年に登場した生成的敵対ネットワーク(GAN)を用いて作成された偽画像のいずれかでした。

コンテンツ戦略:「テーマとバリエーション」

生成されたコンテンツは腐敗撲滅基金を批判し、特にその透明性に疑問を投げかけることに焦点を当てました。作戦は「テーマとバリエーション」戦略を採用し、同じ根本的なメッセージを多数の投稿でわずかな表現の違いを加えて繰り返すことで検出を回避したり、多様な意見があるように見せかけました。

影響評価

OpenAI はこの作戦の影響は限定的と評価しています。特定されたほとんどのアカウントはフォロワーがなく、エンゲージメント(返信)もありませんでした。さらに、このネットワークが生成した英語の返信は、作戦とは無関係の第三者によるロシア語の返信に比べて数が少なく、プラットフォーム上の会話を埋め込むことに成功していないことが示唆されています。

Sources