Главная деталь здесь не только сумма. Ранее судья Уильям Алсуп решил, что само обучение ИИ на купленных или законно полученных книгах может быть добросовестным использованием. В американском праве это означает: копирование иногда разрешено без отдельной лицензии, если новая работа достаточно преобразует исходный материал и не заменяет его на рынке.
Но у Anthropic была другая проблема. По материалам дела, компания скачивала книги из пиратских библиотек вроде Library Genesis и PiLiMi, собирая внутреннюю библиотеку для обучения и проверки моделей. Суд разделил две вещи, которые в публичном споре часто смешивают: чему учится модель и откуда взяли копии для обучения.
Механика простая. Если компания покупает книгу, сканирует её и использует текст как часть обучающего массива, суд может рассматривать это как один спор о допустимости обучения. Если компания берёт тот же текст из пиратской раздачи, появляется отдельный вопрос: незаконная копия уже создана и сохранена, даже если модель потом не цитирует книгу дословно.
Поэтому выплата устроена как компенсация за конкретные произведения. В соглашении фигурируют примерно 500 тысяч книг, по которым правообладатели могут получить до $3000 за произведение. Это не подписка на все будущие тексты и не общий налог на ИИ. Это цена за прошлый способ собрать библиотеку.
Для авторов это первый крупный прецедент, где «нас просто скормили нейросети» превращается в чек с понятной формулой. Для AI-компаний это сигнал ещё жестче: спор об обучении можно пытаться выиграть, но грязный путь к данным становится отдельной бухгалтерской и юридической миной.
Теперь рынок будет смотреть не только на качество моделей, но и на происхождение датасетов. У каждой сильной модели появляется невидимая строка в смете: кто купил тексты, кто получил лицензию, кто надеялся, что старые пиратские архивы растворятся внутри красивого продукта.