TechFlow 보도에 따르면, 7 월 22 일, 여러 작가들이 2024 년에 집단 소송을 제기하여 Anthropic 이 LibGen 등'그림자 도서관'에서 수백만 권의 해적판 전자책을 일괄 다운로드하고 그중 약 48 만 2 천 권의 저작권 보호 작품을 Claude 훈련 데이터베이스에 포함시켰다고 주장했습니다. 법원은 이후'모델 훈련'과'데이터 획득'을 분리하여 판정했습니다. AI 가 합법적으로 취득한 책을 읽어 학습하는 것은 공정 사용에 해당할 수 있으나, 해적 사이트를 통해 다운로드하고 장기 저장하는 행위 자체는 침해에 해당합니다. Anthropic 은 결국 합의금으로 15 억 달러를 지급하는 데 동의했으며, 작품당 평균 약 3000 달러를 보상하고 관련 해적 파일을 파기했습니다.
그러나 Anthropic 은 이전에도 여러 차례 일부 중국 AI 팀이 API 를 통해 Claude 출력을 추출하여 모델 증류를 수행했다고 비난하며, 이는 지식 재산권 규칙을 파괴한다고 주장했습니다. 두 행위는 법적으로 완전히 동일하지는 않지만 뚜렷한 대조를 이룹니다. 인간 작품을 대할 때 AI 회사는 모델에 학습할 권리가 있다고 강조하지만, 자사 모델 출력을 대할 때는 더 강력한 배타적 보호를 요구합니다. 따라서 핵심 경계는 다음과 같습니다. AI 훈련이 반드시 위법한 것은 아니지만, 훈련 데이터의 취득 방식은 합법적이어야 합니다. (jin10)



