深潮 TechFlow 消息,7 月 22 日,多名作家在 2024 年發起集體訴訟,指控 Anthropic從 LibGen 等“影子圖書館”批量下載數百萬份盜版電子書,並將其中約 48.2 萬部受版權保護的作品納入 Claude 訓練資料庫。法院隨後把“模型訓練”與“數據獲取”拆開認定:AI 讀取合法取得的書籍進行學習,可能屬於合理使用;但通過盜版網站下載並長期儲存作品,本身構成侵權。Anthropic 最終同意支付 15 億美元和解,平均每部作品補償約 3000 美元,並銷燬相關盜版文件。
然而,Anthropic 此前多次指責部分中國 AI 團隊通過 API 提取 Claude 輸出進行模型蒸餾,稱其破壞知識產權規則。兩種行為在法律上並不完全相同,但形成了鮮明反差:面對人類作品,AI 公司強調模型有權學習;面對自身模型輸出,又要求更強的排他保護。所以核心邊界是:AI 訓練未必違法,但訓練數據的取得方式必須合法。(金十)




