OpenAI 개인정보 보호 및 뉴욕 타임스 데이터 요구

OpenAI는 뉴욕 타임스로부터 2천만 개의 비공개 ChatGPT 대화를 넘겨달라는 요구에 법적으로 맞서고 있습니다. 회사는 이 요청이 과도한 것이며 진행 중인 두 당사자 간의 소송 해결에 도움이 되지 않고 사용자 개인정보를 위험에 빠뜨린다고 밝혔습니다.

사용자 대화에 대한 법적 분쟁

OpenAI는 2022년 12월부터 2024년 11월까지 기간 동안 무작위로 샘플링된 2천만 개의 ChatGPT 대화에 접근하려는 뉴욕 타임스의 요청에 맞서고 있습니다. 뉴욕 타임스는 이 데이터가 사용자가 페이월을 우회하려는 시도의 예를 찾는 데 필요하다고 주장합니다.

OpenAI는 이 요구를 개인정보 보호 및 보안 관행에 대한 무시로 규정합니다. 회사는 뉴욕 타임스가 이전에 14억 개의 대화를 요구했고 사용자가 개인 채팅을 삭제하는 능력을 제한하려 했으며, 두 경우 모두 OpenAI가 성공적으로 맞섰다고 지적했습니다.

영향을 받는 사용자 및 데이터 범위

이 데이터 요구는 소비자 ChatGPT 대화의 무작위 샘플링을 구체적으로 대상으로 합니다. 다음 매개변수가 영향 범위를 정의합니다:

  • Timeframe: 2022년 12월부터 2024년 11월까지 발생한 대화.
  • Excluded Groups: ChatGPT Enterprise, ChatGPT Edu, ChatGPT Business(이전 "Team)), 및 API 고객은 이 요구의 영향 대상이 아닙니다.
  • Selection Method: 지정된 기간에서 2천만 개의 대화가 무작위로 샘플링되었습니다.

개인정보 완화 및 보안 조치

법적 의무를 이행하면서 사용자 정보를 보호하기 위해 OpenAI는 여러 가지 보호 조치를 시행하고 있습니다:

  • De-identification: OpenAI는 영향을 받는 채팅을 personally identifiable information(PII), 비밀번호 및 기타 민감한 데이터를 제거하는 절차를 통해 처리하고 있습니다.
  • Secure Storage: 법원 명령의 대상인 데이터는 법적 보관 하에 별도의 보안 시스템에 저장되며, 소규모 감사된 법무 및 보안 팀만 접근할 수 있습니다.
  • Access Control: OpenAI는 해당 데이터가 엄격한 법적 프로토콜 하에 보안 환경 내에서 뉴욕 타임스의 외부 변호사 및 기술 컨설턴트만 볼 수 있도록 추진하고 있습니다.

OpenAI는 이전에 뉴욕 타임스에 개인정보 보호를 유지하는 대안을 제시했는데, 예를 들어 뉴욕 타임스 기사 텍스트의 대상 검색 또는 ChatGPT 사용의 고-level 데이터 분류 등이 있었지만 이러한 옵션은 거부되었습니다.

미래 개인정보 로드맵

이러한 개인정보 도전에 대응하여 OpenAI는 무단 데이터 접근을 방지하기 위해 보안 로드맵을 가속화하고 있습니다. 주요 계획된 기능에는 다음이 포함됩니다:

  • Client-side encryption: 이는 ChatGPT와의 메시지가 비공개로 유지되고 OpenAI를 포함한 누구도 접근할 수 없게 함을 보장합니다.
  • Automated safety detection: 회사는 안전 문제를 탐지하기 위한 완전 자동화된 시스템을 구축하고 있습니다. 인간 검토는 소규모 검증된 팀으로 제한되며, 사이버 보안 위협이나 생명에 대한 위협과 같은 critical risks에만 예약됩니다.

OpenAI의 최고 정보 보안 책임자인 Dane Stuckey는 AI가 개인 생활에 점점 더 통합됨에 따라 사용자 신뢰를 유지하기 위해 개인정보 보호가 더욱 강력해져야 한다고 강조합니다.}

Sources