OpenAIのプライバシー保護とニューヨーク・タイムズのデータ要求

OpenAIは、ニューヨーク・タイムズからの2000万件のプライベートなChatGPT会話の提出を求める要求に法的に異議を唱えています。同社は、この要求が過剰であり、両当事者間の継続中の訴訟の解決に役立たず、ユーザーのプライバシーを危険にさらすと述べています。

ユーザー会話に関する法的紛争

OpenAIは、2022年12月から2024年11月までの期間におけるランダムにサンプリングされた2000万件のChatGPT会話へのアクセスを求めるニューヨーク・タイムズの要求に異議を唱えています。ニューヨーク・タイムズは、このデータがペイウォールを回避しようとするユーザーの例を見つけるために必要だと主張しています。

OpenAIは、この要求をプライバシー保護とセキュリティ慣行への無視だと特徴づけています。同社は、タイムズが以前に14億件の会話を要求し、ユーザーがプライベートチャットを削除する能力を制限しようとしたことを指摘しており、これら両方に対してOpenAIは成功裏に抵抗してきました。

影響を受けるユーザーとデータの範囲

このデータ要求は、消費者向けChatGPT会話のランダムサンプリングを特に対象としています。以下のパラメータが影響の範囲を定義します:

  • Timeframe: 2022年12月から2024年11月までの間に発生した会話。
  • Excluded Groups: ChatGPT Enterprise、ChatGPT Edu、ChatGPT Business(以前は「Team」)、およびAPIのお客様はこの要求の影響を受けません。
  • Selection Method: 2000万件の会話は、指定された期間からランダムにサンプリングされました。

プライバシー軽減策とセキュリティ対策

法的義務を遵守しながらユーザー情報を保護するため、OpenAIはいくつかの保護策を実施しています:

  • De-identification: OpenAIは、影響を受けるチャットを個人を特定できる情報(PII)、パスワード、その他の機密データを削除する手順にかけています。
  • Secure Storage: 裁判所の命令の対象となるデータは、法的保持の下で別々のセキュアなシステムに保存され、監査済みの少数の法務およびセキュリティチームのみがアクセスできます。
  • Access Control: OpenAIは、データが厳格な法的プロトコルの下でのセキュアな環境において、タイムズの外部顧問および技術コンサルタントのみによって閲覧されるよう働きかけています。

OpenAIは以前、ニューヨーク・タイムズの記事からのテキストのターゲット検索やChatGPT利用のハイレベルなデータ分類など、プライバシーを保護する代替案を提示しましたが、これらのオプションは拒否されました。

今後のプライバシーロードマップ

これらのプライバシーの課題に対応し、OpenAIは不正なデータアクセスを防ぐためセキュリティロードマップを加速しています。主要な計画機能には以下が含まれます:

  • Client-side encryption: これにより、ChatGPTとのメッセージがプライベートのまま残り、OpenAIを含む誰にもアクセスできなくなります。
  • Automated safety detection: 会社は、安全問題を検出する完全自動化されたシステムを構築しています。人間によるレビューは、少数の精査済みチームに限定され、サイバーセキュリティの脅威や生命への脅威などの重大なリスクにのみ予約されます。

OpenAIの最高情報セキュリティ責任者であるDane Stuckeyは、AIが個人の生活により統合されるにつれて、ユーザーの信頼を維持するためにプライバシー保護はより強力になる必要があると強調しています。

Sources