Авторское право и ИИ. Можно ли законно обучать модели на защищенных книгах
Обучение ИИ на книгах, статьях и других материалах, защищенных авторским правом, остается юридически спорным вопросом. Суды США пока не выработали единого подхода к таким случаям.
Об этом пишет издание TechCrunch .
Модели, используемые ChatGPT, Gemini, Claude и другими ИИ-сервисами, обучаются на огромных массивах данных, включающих книги, научные работы, статьи и другие материалы из интернета. Зачастую авторы не давали на это отдельного согласия.
По словам адвоката Кэти Геллис, специализирующейся на интеллектуальной собственности, авторском праве и технологиях, эта сфера остается сложной из-за большого количества судебных процессов и различных подходов к использованию защищенных произведений.
Одним из важных прецедентов стало дело против Anthropic. В 2025 году судья Уильям Алсап обязал компанию выплатить писателям 1,5 млрд долларов за использование их произведений. В то же время он пришел к выводу, что само по себе обучение ИИ на книгах не нарушало авторское право.
Суд усмотрел проблему в ином: Anthropic получила часть книг из пиратских онлайн-библиотек. То есть компанию наказали не за само обучение моделей, а за незаконное получение материалов.
Алсап сравнил работу языковой модели с процессом обучения писателя, который читает большое количество литературы, чтобы создавать собственные произведения.
Геллис считает, что это решение может быть выгодно для компаний, занимающихся искусственным интеллектом. По ее словам, суд фактически расценил обучение модели как использование и переработку произведения, а не как его копирование. А именно факт копирования имеет ключевое значение для авторского права.
Отдельный вопрос касается так называемого fair use, или добросовестного использования. Это исключение из правил авторского права, которое при определенных условиях позволяет использовать защищенные материалы без разрешения автора. При этом суд оценивает цель использования, объем материала и его влияние на рынок оригинального произведения.
Юрист Джейсон Хендерсон отметил, что суды пока по-разному оценивают использование материалов для обучения ИИ. В частности, проблемы возникают, когда компания использует чужой контент для создания продукта, который напрямую конкурирует с оригиналом.
Такой подход был применен в деле Thomson Reuters против Ross Intelligence. Компания Ross использовала контент Reuters для создания ИИ-платформы в сфере юридических услуг. Суд постановил, что это не являлось добросовестным использованием, поскольку новый продукт конкурировал с платформой Thomson Reuters.
В то же время довод о том, что чат-боты конкурируют с писателями, создавая новые тексты на основе их произведений, пока не получил окончательного подтверждения в судах.
Существует и другая проблема: авторское право и контент, созданный ИИ, регулируются разными нормами. В деле Thaler v. Perlmutter суд постановил, что произведение, созданное исключительно искусственным интеллектом, не может получить защиту авторским правом в США.
Таким образом, остается неясным, как определять долю участия ИИ в создании произведения и доказывать, насколько именно искусственный интеллект повлиял на конечный результат.
Большинство крупных компаний, занимающихся искусственным интеллектом, продолжают участвовать в судебных разбирательствах из-за использования материалов, защищенных авторским правом. Окончательных правил пока не существует, а решения отдельных судов могут изменить дальнейшее развитие этой сферы.
По словам Геллис, первые судебные решения уже влияют на поведение ИИ-компаний, но их подход может измениться после новых разбирательств в других судах.
