OpenAI 與新聞業:回應《紐約時報》訴訟
OpenAI 已公開回應《紐約時報》的訴訟,聲稱相關指控毫無根據,並主張以公開的網路資料訓練 AI 模型屬於合理使用。公司堅持支持新聞業,並積極致力於消除模型輸出中「重複」訓練資料的情形。
AI 訓練屬合理使用與退出機制
OpenAI 主張,使用公開的網路資料訓練 AI 模型在長期以來的判例中屬於合理使用。公司認為此原則對創新者至關重要,亦是維持美國在 AI 競爭力的關鍵。
為支持此立場,OpenAI 引用了向美國版權局提交意見的廣大支持者,包括:
- 學者
- 圖書館協會
- 公民社會團體
- 新創公司
- 領先的美國公司
- 創作者與作者
OpenAI 亦指出,歐盟、日本、新加坡與以色列皆有允許以受版權保護內容訓練模型的相關法律。儘管在合理使用上持有法律立場,OpenAI 仍提供簡易的退出程序,讓出版商可阻止其工具存取其網站,該程序已於 2023 年 8 月被《紐約時報》採用。
處理內容「重複」
OpenAI 將「重複」—即特定訓練資料的記憶—定義為學習過程中的罕見失敗。公司表示,模型的設計目的是學習一般概念以應用於新問題,而非記憶特定文字。
根據 OpenAI 的說法,當內容在多個公開網站上多次出現時,重複的情況較為常見。為了對抗此問題,公司已實施措施以限制無意的記憶。OpenAI 亦強調,故意操控模型重複內容違反其使用條款。
與新聞組織的合作
OpenAI 旨在透過合作支持健康的新聞生態系,重點聚焦於三大目標:
- 營運支援:部署產品協助記者與編輯處理耗時任務,如翻譯報導與分析大量公共紀錄。
- 模型強化:以額外的歷史、非公開內容訓練模型。
- 讀者連結:在 ChatGPT 中即時顯示帶有歸屬的內容,為出版商提供與讀者互動的新方式。
現有的合作夥伴包括美聯社、Axel Springer、美國新聞計畫與紐約大學。
回應《紐約時報》指控
OpenAI 表示,《紐約時報》未完整呈現雙方法律爭議的全貌。公司稱,關於在 ChatGPT 中即時顯示並標註來源的高價值合作談判一直進展順利,直至 2023 年 12 月 19 日止。
針對內容重複的指控,OpenAI 主張:
- 《紐約時報》在談判期間屢次拒絕提供重複案例,即使 OpenAI 承諾進行調查。
- 《紐約時報》所引用的案例似乎是多年以前的文章,已在第三方網站上廣為流傳。
- 《紐約時報》可能使用對抗性提示,包含長篇文章摘錄,故意誘發模型重複內容,這並非一般使用者的行為。
Sources
- OriginalOpenAI and journalism