15 億美元的賠償金: 這是 Anthropic 因使用盜版書籍訓練 AI 模型而付出的代價。這起訴訟不僅揭示了 AI 訓練資料的灰色地帶,也凸顯了著作權保護的重要。
盜版書籍的來源與規模
Anthropic 被控從創世紀圖書館(Library Genesis)及 Pirate Library Mirror 等平台下載盜版書籍,用於其 AI 模型的訓練。2021 年,他們下載了 Books3 資料庫,內容包含 196,640 本未經授權書籍。隨後又從 LibGen 下載至少 500 萬本書籍,2022 年再取得至少 200 萬本內容,累計超過 700 萬本來自未經授權的盜版網站。
內部文件暴露法律風險
據訴訟指控,Anthropic 內部清楚來自盜版網站的資料可能帶來法律風險,但依然選擇保留這批資料。這些資料並非一次性的 AI 訓練資料,而是規劃建立永久保存的中央圖書館,法院指出,數百名工程師都可存取這些內容,甚至能建立額外副本供其他用途使用。
購買紙本書的替代方案
Anthropic 為建立 AI 訓練資料,原本希望取得更多合法內容,甚至提出建立「世界上所有書籍」資料庫的構想,但授權結果不如預期。隨後,他們改以大量購買紙本書方式,投入數百萬美元購買大量紙本書籍,再委託第三方拆除書脊、裁切每一頁並掃描為數位檔。
法院判決的核心觀點
美國加州北區聯邦法院認為,若公司合法購買紙本書,再將內容一對一數位化供 AI 訓練使用,即使紙本遭銷毀,仍可構成合理使用。然而,來自盜版網站下載超過 700 萬本書籍,並建立永久保存的中央圖書館,已超出合理使用範圍。
從產業面來看,這起訴訟不僅是一次法律判決,更是對全球 AI 發展中內容著作權保護的一次警示。Anthropic 的案例提醒我們,即使技術進步日新月異,著作權法仍然是確保創作者權益的重要屏障。AI 公司在追求技術突破的同時,必須更加謹慎地處理訓練資料的來源問題。
行動呼籲
這起訴訟的結果對 AI 行業具有重大影響。作為讀者或創作者,我們應該更加關注自己作品的著作權保護,同時支持合法的內容使用方式。如果你對 AI 訓練資料的來源有疑慮,不妨多了解相關法律規定,確保自己的權益不受侵害。
本文改寫整理自公開新聞來源,原始報導由自由時報發布。
常見問題 FAQ
Anthropic 付了多少賠償金?
Anthropic 同意支付 15 億美元的和解金。
盜版書籍主要來自哪些平台?
盜版書籍主要來自創世紀圖書館(Library Genesis)及 Pirate Library Mirror 等平台。
Anthropic 是否有合法獲取內容的嘗試?
Anthropic 原本希望取得更多合法內容,甚至提出建立「世界上所有書籍」資料庫的構想,但授權結果不如預期。
※ 此篇文章由 AI 改寫或生成,內容僅供參考,可能存在錯誤或不準確之處。










