Высокий суд Дели отклонил запретительный иск ANI против OpenAI по делу об авторском праве
Ключевые выводы
- •Суд отклонил промежуточное ходатайство ANI о судебной защите, но не прекратил основной иск против OpenAI.
- •ANI не смогло доказать, что ChatGPT дословно воспроизводил его статьи, даже после использования промптов с просьбой о точном копировании.
- •Судья Амит Бансал предварительно установил, что обучение ИИ может подпадать под индийское исключение для частного исследовательского использования, если материалы получены законно и обрабатываются внутри компании.
- •Суд оставил вопросы о Retrieval Augmented Generation и о том, являются ли связанные с ним ответы доведением до всеобщего сведения, для основного разбирательства.
- •Решение принято на фоне противоречивой международной практики по вопросу о том, нарушают ли обучение ИИ и его выводы авторское право или подпадают под правовые исключения.

Высокий суд Дели отклонил ходатайство индийского информационного агентства Asian News International (ANI) о предварительном судебном запрете против OpenAI в споре об авторском праве, связанном с обучением ИИ и ответами ChatGPT.
ANI, одно из крупнейших информационных агентств Индии, подало иск против OpenAI из-за предполагаемого использования защищенных авторским правом новостных материалов при обучении моделей и в ответах, генерируемых ChatGPT. В промежуточном решении судья Амит Бансал отказал в удовлетворении требований по обоим основаниям, рассмотрев вопросы запоминания моделью, Retrieval Augmented Generation (RAG) и правового статуса использования защищенных авторским правом произведений для обучения ИИ-систем. Это решение не завершает судебный процесс; оно фиксирует предварительную позицию суда, оставляя ряд вопросов для основного разбирательства.
Эксперт по праву авторского права в сфере ИИ Андрес Гуадамус назвал это решение важной ранней победой OpenAI. Его анализ доступен по адресу Судебный документ также был опубликован по адресу
Доказательства ANI не подтвердили дословное воспроизведение
ANI представило суду несколько ответов ChatGPT, которые, по утверждению агентства, были существенными копиями его статей. OpenAI ответила, что задействованные модели, GPT-4 и GPT-4o, обучались на наборах данных от April 2022 и April 2024. Большинство статей, на которые ANI ссылалось в качестве доказательств, были опубликованы в August и September 2024, а значит, не могли входить в эти обучающие наборы данных.
Предварительная позиция судьи Бансала заключалась в том, что сходство в ответах, по-видимому, было результатом Retrieval Augmented Generation — метода, позволяющего языковой модели извлекать актуальную онлайн-информацию в реальном времени способом, сопоставимым с работой поисковой системы. Поскольку ANI не рассмотрело RAG в своем заявлении, суд не вынес окончательного решения по этому вопросу. Судья указал, что ответы на основе RAG потенциально могут квалифицироваться как “communication to the public”, и этот вопрос оставлен для основного разбирательства.
Суд также отметил, что ANI использовало состязательные промпты, прямо инструктируя модель воспроизводить статьи “exactly.” Даже с такими промптами ANI не представило ни одной дословной копии. Судья установил, что факты, содержащиеся в новостных статьях, как правило, не охраняются авторским правом, а воспроизведение тем и заголовков в данном случае не являлось прямой конкуренцией с ANI.
Доказательства не подтвердили утверждение ANI о том, что OpenAI постоянно хранит обучающие данные в своих моделях и может по запросу дословно воспроизводить работы агентства. Суд заявил, что этот вопрос будет повторно рассмотрен в рамках основного разбирательства.
Суд предварительно поддержал подход к обучению ИИ как к частному использованию
На промежуточной стадии ANI также не доказало, что копирование OpenAI его материалов для обучения ИИ являлось нарушением авторского права. Обе стороны согласились, что OpenAI использовала контент ANI в ходе обучения. OpenAI утверждала, что эти материалы составляли лишь ничтожную часть общего набора данных, а модель извлекала невыразительные элементы, включая грамматику, синтаксис и языковые закономерности.
Судья рассмотрел исключения, предусмотренные индийским законодательством об авторском праве, и сослался на положение о “private or personal use, including research.” На данной стадии он истолковал “research” достаточно широко, чтобы включить в это понятие обучение ИИ.
Суд установил пределы такого подхода. Копии для обучения должны происходить из законных источников, а не из теневых библиотек или сайтов с платным доступом, полученным без разрешения. Судья также отметил, что OpenAI не делала обучающие копии публичными и обрабатывала их только внутри компании. Гуадамус заявил, что это первый случай, когда суд прямо признал, что обучение ИИ подпадает под исключение для частного использования.
Суд применил трехчастный тест справедливости и по всем трем пунктам встал на сторону OpenAI. Он указал, что использование OpenAI работ ANI было ограничено обучением, поскольку запоминание или воспроизведение не были доказаны. ANI также не смогло показать экономический ущерб, отчасти потому, что две организации работают в разных секторах. Согласно решению, даже когда пользователи спрашивают ChatGPT о заголовках ANI, модель возвращает только темы и, самое большее, несколько названий статей.
Судья Бансал сослался на дела в США, включая Bartz v. Anthropic и Kadrey v. Meta, где выводы языковых моделей рассматривались как трансформативные. Он также упомянул более раннее решение по делу Google Books.
Суд также установил, что обученные языковые модели могут улучшать доступ к информации, поддерживать образование, продвигать научные исследования, помогать в разработке программного обеспечения, обеспечивать перевод и создавать инструменты для людей с инвалидностью.
Глобальные решения по авторскому праву и ИИ остаются неоднородными
Решение в Дели дополняет растущий массив международных судебных решений, которые приходят к разным выводам по вопросам ИИ и авторского права. В Соединенных Штатах судья отклонил иск Raw Story и AlterNet против OpenAI, поскольку истцы не смогли показать достаточный ущерб, а вероятность точных копий была низкой. Этот суд также постановил, что факты не охраняются авторским правом.
Дело GitHub Copilot также завершилось неудачей для истцов, которые не смогли указать ни одного примера идентичного кода. The Intercept, напротив, одержал частичную победу по требованию DMCA, связанному с защищенными авторским правом материалами, из которых перед обучением были удалены сведения об авторских правах.
В деле Ross Intelligence v. Thomson Reuters суд отклонил защиту на основании fair use, поскольку исследовательский ИИ-инструмент напрямую конкурировал с юридической базой данных Thomson Reuters Westlaw, что делало использование нетрансформативным. Суд подчеркнул, что это решение относится только к данному негенеративному случаю использования и не может быть распространено на большие языковые модели.
В деле Anthropic федеральный суд в Сан-Франциско охарактеризовал обучение ИИ на защищенных авторским правом произведениях как “spectacularly” трансформативное, что стало сильным сигналом в пользу fair use. Однако суд также провел “Napster comparison”, поскольку Anthropic использовала пиратские книги из теневых библиотек в качестве обучающих данных. Fair use не распространяется на незаконно полученные материалы. Позднее Anthropic выплатила авторам книг $1.5 billion за использование этих пиратских копий.
U.S. Copyright Office отвергло аргумент индустрии ИИ о том, что обучение на “vast troves of copyrighted works” в широком смысле подпадает под fair use. Чиновник, подготовивший отчет, был уволен администрацией Трампа вскоре после его публикации.
Европейские суды также разошлись во мнениях. Региональный суд Мюнхена по делу GEMA постановил, что тексты песен воспроизводимы в весах модели, что делает модель воспроизведением, имеющим значение для авторского права. Высокий суд в Лондоне отклонил иск Getty Images v. Stability AI, постановив, что ИИ-модель не является “infringing copy.” Исследования, показывающие, что языковые модели могут запоминать защищенные авторским правом книги, могут усилить дискуссию о запоминании.
Во всех этих делах остаются нерешенными несколько ключевых вопросов: хранят ли ИИ-модели обучающие данные постоянно, может ли обучение подпадать под fair use или сопоставимое исключение, где проходит граница между законно и незаконно полученными данными, и отражают ли ответы, сгенерированные с помощью состязательных промптов, обычное использование. Решение в Дели важно, поскольку рассматривает несколько таких вопросов в одном постановлении, но его промежуточный характер означает, что последующие доказательства все еще могут повлиять на подход суда к обучению, извлечению данных и ответственности за ответы.
Медиа сталкиваются с проблемами за пределами авторского права
Спор также подчеркивает более широкую проблему для медиаиндустрии. Даже если суды решат, что обучение ИИ является законным, поисковые продукты на базе ИИ все равно могут повлиять на рынок новостей. Недавнее исследование Pew Research Center показало, что доля переходов на внешние сайты падает до 8 percent, когда появляются Google’s AI Overviews, по сравнению с 15 percent без ИИ-сводки. Пользователи, как правило, прекращают поиск после получения ответа ИИ и часто не обращаются к другим источникам.
Для информационных агентств, таких как ANI, ИИ-системы, которые резюмируют новости и сокращают необходимость перехода к первоисточнику, со временем могут ослабить бизнес-модель отрасли даже без установления прямого нарушения авторского права.
Региональный суд Мюнхена I также недавно постановил, что Google несет прямую ответственность за ложные утверждения в своих ИИ-сводках, поскольку такие сводки считаются самостоятельным контентом, а не результатами поиска. Ограниченная ответственность, которая традиционно защищала операторов поисковых систем, согласно этому решению, не распространяется на сгенерированные ИИ сводки.
Такая логика может стать релевантной и для ответов ChatGPT на основе RAG. Когда ИИ-системы резюмируют новости и делают самостоятельные утверждения, их операторы могут рассматриваться как поставщики медиауслуг с соответствующей ответственностью. Такой сдвиг может также повлиять на анализ fair use, где одним из факторов является то, конкурирует ли новый продукт с произведениями, на которых он обучался. Если ИИ-сводки заменяют посещение новостных сайтов, судам может стать сложнее признавать такое использование неконкурентным.