聯邦法官批准 Anthropic 與作家之間高達 15 億美元的和解協議,該案涉及盜版書籍用於訓練其 Claude AI 模型。
聯邦法官批准 Anthropic 與作家之間高達 15 億美元的和解協議,該案涉及盜版書籍用於訓練其 Claude AI 模型。

舊金山聯邦法官批准了 Anthropic 提出的 15 億美元和解協議。作家們指控該公司使用超過 48 萬冊盜版書籍來訓練其 Claude 聊天機器人,這起案件是美國首宗以賠償作結的重大 AI 開發商著作權訴訟。
本案原告集體訴訟律師 Justin Nelson 表示:「這是 AI 時代首例,為要求 AI 公司向版權所有者付費樹立了先例。」
該和解協議涵蓋超過 48 萬冊作品,每本書約賠償 3,000 美元。集體訴訟律師向法院指出,符合資格的作品中有超過 90%(逾 44 萬冊)提出了索賠,遠高於集體訴訟通常約 10% 的索賠率。Anthropic 將分四期支付,至 2027 年 9 月付清,其中首期 3 億美元已存入附息託管帳戶。
此賠償金額源於現已退休的法官 William Alsup 做出的分歧裁決。他認為,用書籍訓練 Claude 具有「極強的轉化性」,因此屬於合理使用——但從影子圖書館 Library Genesis 和 Pirate Library Mirror 下載並儲存超過 700 萬冊盜版書籍,則不屬於合理使用。由於美國著作權法對故意侵權行為,每件作品的賠償金最高可達 15 萬美元,如此規模的圖書館使 Anthropic 面臨理論上數千億美元的賠償責任。該公司最終選擇和解,而非在預定於 2025 年 12 月進行的審判中測試這一數字。
每本書 3,000 美元的代價重塑 AI 數據經濟
該和解協議將每件作品的價值定為約 3,000 美元,但反對者認為,對於 Anthropic 這樣規模的公司而言,總金額太小,不足以起到威懾作用。獲亞馬遜和 Alphabet 投資的 Anthropic 未承認任何不當行為。該公司還必須銷毀從兩個影子圖書館取得的原始檔案,以及據此製作的任何副本。集體訴訟律師將費用請求削減至賠償基金總額的約 12.5%,低於此類案件中常見的約 30%,但反對者仍認為律師分成過高,且該協議錯誤地排除了未在美國註冊的作品。少數作家和出版商選擇退出,以自行提出索賠,這些案件仍在進行中。
儘管和解協議僅對雙方具有約束力,並未為未來法院必須遵循的判例,但它為未經授權的訓練數據設立了一個市場價格,這將在整個行業中產生連鎖反應。將此類案件辯護至審判階段,費用可能高達數百萬美元,而法定賠償金則可能帶來災難性後果。對於開發大型語言模型的企業而言,營運上的教訓很明確:那些授權或合法購買訓練材料的公司,其風險遠低於那些使用免費侵權副本的公司。這一區別也獎勵了那些從訓練流程中清除可疑數據來源的公司。
這項和解對 OpenAI、Meta 和 Google 意味著什麼
Anthropic 是數十起 AI 著作權訴訟中——包括針對 OpenAI、微軟和 Meta 的案件——首個以如此規模達成和解的案例。對業界其他公司而言,這項範圍狹窄的和解僅涵蓋 Anthropic 過去如何取得這些書籍。它並未授予繼續使用這些書籍進行訓練的許可,也與 Claude 實際生成的內容無關。作家們保留就模型輸出以及任何未列入和解清單的書籍提起訴訟的權利。
關於抓取開放網路是否構成合理使用這一尚未解決的問題,將決定 AI 訓練著作權爭戰的下一階段。就目前而言,這項和解協議為 AI 公司如何解決類似索賠提供了範本:為過去的數據使用付費、銷毀侵權副本,並就未來的授權進行談判。
對於 AI 開發商而言,這項和解提高了訓練數據採購的成本。Anthropic 支付的 15 億美元——約相當於該公司從包括亞馬遜和 Alphabet 在內的投資者籌集的 100 億美元的 15%——代表著一筆重大的資本流出,可能會對整個產業的新創公司估值造成壓力。面臨作家及包括《紐約時報》在內的新聞媒體類似訴訟的 OpenAI,可能需要為潛在的和解或授權協議預留準備金。同樣因使用受版權保護的書籍訓練其 Llama 模型而被起訴的 Meta,也面臨類似的風險敞口。市場目前正在將訓練數據將帶來重大成本的可能性納入定價——這是從過去將網路規模數據抓取視為免費的時代轉變。
本文僅供參考,不構成投資建議。