Крупные издательства Hachette Book Group, Cengage Learning и Elsevier вместе с американским писателем Скоттом Туроу подали коллективный иск против Google. Истцы утверждают, что компания без отдельного разрешения использовала миллионы защищенных книг, учебников и научных статей для обучения нейросети Gemini. Требования заявлены не только от имени участников дела, но и от имени предполагаемой группы авторов и издателей.
Спор затрагивает произведения, ранее переданные Google для ограниченных целей. Издатели разрешали показывать короткие отрывки в Google Книгах, продавать электронные издания через Google Play Книги и облегчать поиск научных публикаций. Однако, по версии истцов, эти соглашения не давали права копировать тексты для обучения коммерческой системы искусственного интеллекта.
Обучение Gemini на книгах: какие обвинения предъявлены Google?
Авторы и издательства заявляют, что Google могла использовать как легально полученные материалы, так и тексты из закрытых или пиратских источников. В иске также говорится о возможном удалении сведений об авторстве и правах, из-за чего установить происхождение обучающих данных становилось сложнее.
Правообладатели требуют прекратить предполагаемое нарушение, выплатить предусмотренную законом компенсацию и уничтожить неразрешенные копии произведений. По их мнению, Gemini способна создавать дешевые заменители книг, статей и учебных материалов, сокращая продажи оригиналов и ослабляя рынок лицензирования.
Отдельное внимание привлекли внутренние оценки рисков, приведенные истцами. Согласно материалам дела, сотрудники Google якобы заранее понимали, что обучение нейросети на книгах может вызвать претензии и привести к требованиям на десятки миллиардов долларов. На момент выхода первых сообщений компания не представила развернутого ответа по существу обвинений.
Google Gemini и авторские права: что изменится для рынка нейросетей?
Дело важно не только для книжной отрасли. Суду предстоит определить, где заканчивается допустимый анализ произведений и начинается использование, требующее отдельного согласия правообладателя. Решение может повлиять на разработчиков нейросетей, образовательные площадки, владельцев сайтов и компании, создающие продукты на основе чужих текстов.

Для разработчиков главный практический вывод уже очевиден: происхождение обучающих данных становится таким же важным, как возможности самой нейросети. Необходимо хранить сведения об источниках, условиях лицензирования и разрешениях авторов. Компаниям, использующим готовые системы искусственного интеллекта, стоит заранее выяснять, кто отвечает за возможные нарушения.
Экспертный вывод
Иск против Google показывает, что период бесконтрольного сбора текстов постепенно заканчивается.
Рекомендация: выбирать нейросети с прозрачными правилами работы с данными, не загружать закрытые книги и документы без разрешения, а созданные материалы обязательно проверять перед публикацией. Юридическая чистота обучающих данных вскоре может стать одним из главных преимуществ систем искусственного интеллекта.

