OpenAI와 저널리즘: 뉴욕 타임스 소송에 대한 답변

OpenAI와 저널리즘: 뉴욕 타임스 소송에 대한 답변

OpenAI는 공개 인터넷 데이터를 사용한 AI 모델 훈련이 공정 사용이라고 주장하고, 저작권이 있는 콘텐츠의 재현을 드문 버그로 설명하며, 뉴욕 타임스의 소송에 대응하고 있습니다.

OpenAI와 저널리즘: 뉴욕 타임스 소송에 대한 답변

OpenAI는 뉴욕 타임스의 소송에 공개적으로 답변하며, 해당 주장에 근거가 없으며 공개적으로 이용 가능한 인터넷 자료를 사용한 AI 모델 훈련이 공정 사용에 해당한다고 주장했습니다. 회사는 저널리즘을 지원하고 있으며 모델 출력에서 훈련 데이터의 "재현"을 제거하기 위해 적극적으로 노력하고 있다고 밝혔습니다.

AI 훈련의 공정 사용 및 옵트아웃 메커니즘

OpenAI는 공개적으로 이용 가능한 인터넷 자료를 사용한 AI 모델 훈련이 오랜 선례에 따라 공정 사용으로 허용된다고 주장합니다. 회사는 이 원칙이 혁신가들에게 필수적이며 미국의 AI 경쟁력을 유지하는 데 중요하다고 말합니다.

이 입장을 뒷받침하기 위해 OpenAI는 미국 저작권 사무국에 의견을 제출한 다양한 지지자들을 인용합니다, 포함하여:

  • 학계
  • 도서관 협회
  • 시민사회 단체
  • 스타트업
  • 미국 선도 기업
  • 창작자 및 저자

OpenAI는 또한 유럽 연합, 일본, 싱가포르, 이스라엘에서도 저작권이 있는 콘텐츠에 대한 모델 훈련을 허용하는 유사한 법률이 존재한다고 언급합니다. 공정 사용에 대한 법적 입장에도 불구하고, OpenAI는 출판사가 자사 도구가 해당 사이트에 접근하는 것을 방지할 수 있는 간단한 옵트아웃 절차를 제공하며, 이 절차는 뉴욕 타임스가 2023년 8월에 채택했습니다.

콘텐츠 "재현" 문제 해결

OpenAI는 "재현"—특정 훈련 데이터를 기억하는 것—을 학습 과정의 드문 실패로 정의합니다. 회사는 모델이 특정 텍스트를 암기하기보다 새로운 문제에 적용할 일반 개념을 학습하도록 설계되었다고 말합니다.

OpenAI에 따르면, 콘텐츠가 여러 공개 웹사이트에 여러 번 나타날 때 재현이 더 흔합니다. 이를 방지하기 위해 회사는 의도치 않은 기억을 제한하는 조치를 시행했습니다. OpenAI는 또한 모델을 의도적으로 조작해 콘텐츠를 재현하도록 하는 행위는 이용 약관 위반이라고 강조합니다.

뉴스 조직과의 협업

OpenAI는 세 가지 주요 목표에 초점을 맞춘 파트너십을 통해 건강한 뉴스 생태계를 지원하고자 합니다:

  1. 운영 지원: 스토리 번역 및 방대한 공공 기록 분석과 같은 시간 소모적인 작업을 기자와 편집자가 수행하도록 돕는 제품을 배포합니다.
  2. 모델 향상: 추가적인 역사적이며 공개되지 않은 콘텐츠를 사용해 모델을 훈련합니다.
  3. 독자 연결: ChatGPT에서 실시간 콘텐츠를 출처와 함께 표시하여 출판사가 독자와 연결되는 새로운 방식을 제공합니다.

기존 파트너십으로는 Associated Press, Axel Springer, American Journalism Project, NYU와의 협업이 포함됩니다.

뉴욕 타임스 주장에 대한 답변

OpenAI는 뉴욕 타임스가 법적 분쟁에 대한 전체 이야기를 제시하지 않고 있다고 주장합니다. 회사는 ChatGPT에서 실시간 표시와 출처 표기를 포함한 고부가가치 파트너십 협상이 2023년 12월 19일까지 건설적으로 진행되었다고 밝혔습니다.

콘텐츠 재현 주장에 대해 OpenAI는 다음과 같이 주장합니다:

  • 뉴욕 타임스는 OpenAI가 조사에 전념했음에도 불구하고 협상 중에 재현 사례를 공유하는 것을 반복적으로 거부했습니다.
  • 뉴욕 타임스가 인용한 사례는 수년 전 기사로, 제3자 웹사이트에 퍼진 것으로 보입니다.
  • 뉴욕 타임스는 아마도 기사 긴 발췌를 포함한 적대적 프롬프트를 사용해 모델이 의도적으로 콘텐츠를 재현하도록 유도했으며, 이는 일반 사용자 활동이 아닙니다.

Sources