著作権侵害されたトレーニングデータに関するAnthropicの15億ドルの和解金
著作権侵害されたトレーニングデータに関するAnthropicの15億ドルの和解金
Anthropicは、Claude大規模言語モデル(LLM)のトレーニングに海賊版の書籍を使用したという疑惑を解決するため、15億ドルの和解に達しました。この和解は、重要な法的区別を浮き彫りにしています。著作権で保護されたテキストでAIモデルをトレーニングする行為は「フェアユース(公正利用)」とみなされる可能性がありますが、海賊版のソースを通じてそのデータを取得する行為はそうではありません。
和解条件と支払い
15億ドルの解決策は、影響を受けた著者や出版社に金銭的な補償を提供しますが、クラス代表者と一般クラスの間での資金の分配は大きく異なります。
- 作品ごとの支払い: 対象となる作品には、それぞれ約3,000ドルが支払われます。従来の出版契約では、この金額は通常、著者と出版社の間で分割されます。
- クラス代表者の報酬: 3名のクラス代表者は、それぞれ15,000ドルを受け取ることになっています。
- 弁護士費用: 担当判事は、クラス弁護士が要求した費用を半分に減額し、12.5%(1億8,750万ドル)から6.8%(1億100万ドル)に引き下げました。未払い済みの訴訟費用は合計260万ドルに達しました。
法的先例:海賊版 vs. フェアユース
このケースの鍵となる要素は、AIトレーニングの性質に関する司法判断です。Alsup判事は以前、Anthropicは書籍の入手に関わる海賊版行為について責任を負うものの、その書籍を用いてLLMをトレーニングするというその後の行為はフェアユースを構成すると述べる命令を下しました。
この区別は、AI企業にとっての法的リスクが、「学習」プロセスそのものよりも、使用されるデータセットの出所(プロベナンス)にある可能性を示唆しています。この和解における核心的な問題は、トレーニングのための書籍の使用ではなく、書籍が海賊版であったという事実でした。
業界とコミュニティの反応
この和解は、罰則の妥当性とAI業界への影響について、法律の専門家やクリエイティブ・コミュニティの間で大きな議論を巻き起こしています。
和解金額に対する批判
多くの観察者は、15億ドルという数字は、一見大きく見えるものの、抑止力というよりも「事業継続コスト」を表していると主張しています。批判的な人々は、商業的な著作権侵害に対して禁錮刑や重い罰金を科すことができる連邦著作権法を指摘し、民事的な和解は寛大な結果であると示唆しています。
"This is not even than a slap on the wrist. Publishers who negotiated this really fucked up writers. According to US federal law, pirating a single copyrighted work and gaining commercial advantage of it... represents five years in prison and a $250,000 fine."
オープンアクセスへの主張
逆に、一部の人々は、現在の著作権制度は情報の効率的な移動を阻害する人工的な独占であると主張しています。この観点からは、既存の知識を用いたAIのトレーニングは、情報アクセスの必要な進化とみなされ、焦点は商業的に取引される著作物ではなく、個人のプライベートなデータを保護することに置かれるべきであると考えています。
他のモデルへの影響
この和解は、他のAI開発者、特に「オープン」なモデルを作成している開発者について疑問を投げかけています。もしAnthropicが使用したデータセットが業界全体で一般的であるならば、他のモデル開発者もトレーニングデータの出所に関する同様の法的課題に直面する可能性があります。