Разработчики искусственного интеллекта используют огромные массивы книг, статей и научных работ, нередко без прямого согласия авторов. Но это еще не означает, что любое обучение нейросети нарушает закон. Американские суды оценивают способ получения данных, цель обработки и возможный ущерб рынку оригинальных произведений.
Обучение нейросетей на книгах допустимо не во всех случаях
Показательным стал спор писателей с компанией Anthropic. Судья Уильям Алсуп счел само обучение языковой модели преобразующим использованием: система анализирует тексты ради нового результата, а не хранит книги для чтения или продажи. При этом компания согласилась выплатить 1,5 млрд долларов для урегулирования претензий к произведениям, полученным из незаконных сетевых библиотек.

Так возникло важное разграничение. Законно приобретенное произведение и незаконно скачанная копия могут участвовать в одном вычислительном процессе, но правовая оценка будет разной. Решение не дает разработчикам общего разрешения на любые данные и не лишает авторов защиты от прямого копирования.
Авторское право и искусственный интеллект зависят от конкуренции
В США подобные споры рассматривают через правила добросовестного использования. Суд учитывает цель обработки, характер произведения, объем заимствования и влияние на рынок. Риск особенно высок, если новая система решает ту же задачу и отнимает спрос у владельца исходных материалов.
Это показало дело Thomson Reuters против Ross Intelligence. Создатель правовой поисковой системы использовал материалы конкурента для разработки сходного продукта. Суд не увидел достаточно новой цели и не признал такое применение допустимым. Следовательно, важно не только обучение ИИ, но и то, заменяет ли его результат исходный товар.
Использование книг для обучения ИИ остается правовым риском
Единого правила пока нет: другие суды могут иначе оценить цель обучения, источник файлов или ущерб рынку. Отдельный вопрос касается результата нейросети. В США произведение, полностью созданное машиной без творческого вклада человека, не получает обычной защиты авторским правом. Установить долю человеческого участия на практике непросто.
Издателям и авторам полезно фиксировать права, условия лицензирования и случаи дословного воспроизведения. Разработчикам необходимы документы о происхождении данных и полученных разрешениях. Пользователям коммерческих систем стоит проверять материалы на совпадения с источниками перед публикацией книг, обзоров и учебных пособий.
Экспертный вывод
Судебная практика показывает: технология обучения не снимает ответственности за незаконное получение текстов и создание продукта, заменяющего оригинал.
Рекомендация: вести проверяемый учет происхождения данных, а авторам – хранить исходники и отслеживать буквальное воспроизведение произведений. Пока единый правовой стандарт не сформирован, прозрачность и лицензии надежнее предположений о допустимости.
