Несколько крупных издательств требуют компенсацию за allegedly незаконное обучение ИИ-моделей Meta на охраняемых авторским правом произведениях. Это следует из коллективного иска (откроется в новом окне) (PDF), который издательства Elsevier, Cengage, Hachette, Macmillan, McGraw, а также автор Скотт Туроу подали 5 мая 2026 года в суд Нью-Йорка.
Издательства повторяют обвинения в адрес Meta, которые ранее, в июле 2023 года, уже выдвигались авторами. «Сначала они незаконно загрузили миллионы охраняемых авторским правом книг и журнальных статей с печально известных пиратских сайтов и осуществили несанкционированный веб-скрапинг практически всего интернета», — говорится в исковом заявлении издательств.
И далее: «Затем они бесчисленное количество раз копировали эти украденные материалы для обучения миллиардной генеративной ИИ-системы Meta под названием Llama. Тем самым ответчики совершили одно из самых массовых нарушений авторских прав в истории».
Цукерберг якобы одобрил эти действия
Глава Meta Марк Цукерберг лично «одобрил и активно способствовал» нарушению закона. Компания также удалила информацию об управлении авторскими правами (CMI), «чтобы скрыть источники обучения и облегчить их несанкционированное использование».
Согласно иску, Meta и Цукерберг изначально пытались приобрести лицензии на литературные произведения у крупных издательств. Однако затем они выбрали другой путь и загрузили произведения «с торрент-сайтов и печально известных пиратских ресурсов, включая LibGen, Anna's Archive, Sci-Hub, Sci-Mag и другие».
По мнению истцов, пользователи высоко ценят способность ИИ-моделей с легкостью создавать книги. «Масштаб и скорость, с которой Llama может создавать письменные произведения и конкурировать с авторами-людьми, беспрецедентны, и это возможно только потому, что ответчики скопировали произведения истцов и участников коллективного иска для обучения своей LLM», — говорится в заявлении.
Ущерб пока не оценен
При этом ущерб от предполагаемого нарушения закона не ограничивается созданием конкурирующих результатов. Он возникает уже на этапе считывания данных для создания ценной коммерческой системы. «Такое поведение присваивает экономическую ценность произведений, уничтожает легальный лицензионный рынок и позволяет ответчикам получать выгоду от инвестиций, которые они не делали. Именно такой ущерб и призвано предотвращать авторское право», — пишут истцы.
Возможный ущерб не оценивается в денежном выражении, этот вопрос должен быть решен в ходе судебного разбирательства. Это связано, в том числе, с тем, что полный объем произведений, использованных Meta, неизвестен, говорится в иске. Соответствующий закон США (откроется в новом окне) предусматривает возмещение ущерба в размере до 25 000 долларов за каждое нарушение мер CMI.
Meta ссылается на добросовестное использование
Meta отвергла обвинения. «Искусственный интеллект стимулирует революционные инновации, производительность и творчество для частных лиц и компаний, и суды справедливо постановили, что обучение ИИ на материалах, защищенных авторским правом, может считаться добросовестным использованием», — заявил представитель Meta Дэйв Арнольд изданию New York Times (откроется в новом окне), добавив: «Мы будем решительно защищаться от этого иска».
В настоящее время рассматривается множество исков от издательств против ИИ-компаний по поводу предполагаемых нарушений авторских прав. Так, Encyclopedia Britannica в своем иске обвиняет ИИ-компанию OpenAI в массовом использовании охраняемого авторским правом контента для обучения ИИ-моделей. В апреле 2025 года New York Times уже частично выиграла суд в своем иске против OpenAI.