Компании, разрабатывающие искусственный интеллект, продолжают массово покупать бумажные, в том числе редкие книги, чтобы использовать их для обучения языковых моделей. После покупки книги разбирают на страницы, срезая корешок, сканируют, создают цифровые копии, а затем зачастую утилизируют. Такой способ оцифровки оказался быстрее и дешевле, чем обычное сканирование.
Именно эта практика стала одной из причин громких судебных разбирательств в США, как сообщают иностранные СМИ. Авторы считают, что их произведения использовались для обучения нейросетей без разрешения и выплаты вознаграждения. Среди тех, кто подал иски к разработчикам ИИ, — писательница и комик Сара Сильверман, писатели Майкл Шейбон, Та-Нехиси Коутс, Пол Тремблей, Андреа Бартц и другие. Они предъявили претензии компаниям Meta*, Anthropic, OpenAI и ряду других разработчиков.
Отдельный иск против Anthropic привлек особое внимание. В июне 2026 года федеральный суд США рассмотрел вопрос о том, можно ли использовать законно приобретенные книги для обучения искусственного интеллекта. Суд пришел к предварительному выводу, что само обучение модели на легально купленных книгах может подпадать под принцип fair use («добросовестное использование»), однако отдельно указал: если произведения были получены из пиратских библиотек, это не освобождает компанию от ответственности за возможное нарушение авторских прав. Именно поэтому разбирательство продолжается — суду еще предстоит оценить происхождение миллионов файлов, использованных при обучении моделей.
По данным американских СМИ, Anthropic приобрела миллионы бумажных книг, после чего их разбирали, сканировали и переводили в цифровой формат для создания собственной библиотеки текстов. Эти материалы использовались при обучении больших языковых моделей Claude. Именно эта информация стала известна из судебных документов, опубликованных в ходе процесса.
«Проиграет не творчество, а посредственность»: лишатся ли работы композиторы и аранжировщики в эпоху ИИ
Параллельно вопрос регулирования искусственного интеллекта обсуждают и в России. 26 июля 2026 года президент Владимир Путин подписал Федеральный закон «О поддержке развития технологий искусственного интеллекта». Документ впервые комплексно регулирует работу с ИИ, устанавливает требования к разработчикам и пользователям таких систем, а также вводит правила обращения с объектами авторского права.
Согласно закону, для обучения искусственного интеллекта допускается использовать произведения, если они получены законным способом или были правомерно опубликованы. Кроме того, документ предусматривает обязательную маркировку аудио-, фото-, видео- и другого контента, созданного с помощью искусственного интеллекта. Большинство положений закона вступят в силу с 1 сентября 2026 года, а нормы о маркировке — с 1 марта 2027 года.
Таким образом, пока американские суды пытаются определить границы использования книг для обучения нейросетей и решить, нарушаются ли права авторов, Россия делает ставку на законодательное регулирование работы искусственного интеллекта и прозрачность создаваемого им контента.
*Компания Meta признана экстремисткой на территории Российской ФедерацииЧитайте также
- МВД России собрался бороться с ии при помощи ИИ
- Как искусственный интеллект меняет российский бизнес: что уже делают нейросети вместо сотрудников
- С 1 сентября отменены домашние задания для первоклассников