TechFlow によると、7 月 22 日、複数の作家が 2024 年に集団訴訟を提起し、Anthropic が LibGen などの「シャドウライブラリ」から数百万冊の海賊版電子書籍を一括ダウンロードし、そのうち約 48 万 2000 部の著作権で保護された作品を Claude の訓練データセットに組み入れたと指摘した。裁判所はその後、「モデル訓練」と「データ取得」を分けて認定し、AI が合法に取得した書籍を読み込んで学習することはフェアユースに該当する可能性があるが、海賊版サイトを通じて作品をダウンロードし長期保存すること自体は侵害を構成するとした。Anthropic は最終的に 15 億ドルの和解金を支払うことに同意し、作品あたり平均約 3000 ドルを補償し、関連する海賊版ファイルを破棄した。
しかし、Anthropic はこれまで、一部の中国 AI チームが API を通じて Claude の出力を抽出しモデル蒸留を行っていると何度も非難し、それが知的財産権ルールを破壊すると称した。両者の行為は法的に完全に同じではないが、鮮明な対照を成している。人間の作品に対し、AI 企業はモデルに学習する権利があると強調するが、自社のモデル出力に対し、より強力な排他的保護を要求する。したがって核心的な境界線は以下の通りだ。AI 訓練は必ずしも違法ではないが、訓練データの取得方法は合法でなければならない。(金十)



