Администрация США встала на сторону OpenAI в давящемся судебном деле. Новое президентское заключение в 20 страниц защищает право компании на использование защищённого авторским правом контента для обучения языковых моделей — без лицензии и разрешения авторов. Позиция правительства опирается на стратегический интерес страны: чтобы американский ИИ оставался конкурентным на глобальном рынке, нужно позволить компаниям обучать модели на максимально полных наборах данных.

В деле New York Times против OpenAI уже несколько лет идёт борьба за то, попадает ли обучение ИИ под принцип «добросовестного использования» (fair use) американского авторского права. На традиционных языках это понятие предусматривает исключения для учебных и трансформативных целей. Администрация в своём заключении настаивает, что лингвистические модели, как и люди, читают книги не для того, чтобы их воспроизвести, а чтобы создать что-то новое — и это трансформативное использование, поэтому оно должно быть легально.

История судебных исков по этому вопросу пока складывается в пользу ИИ-компаний. В прошлом году судья Уильям Алсап в решении по делу Anthropic признал, что обучение моделей на копирайте как таковом не является нарушением — фактически расценив это как аналогию с тем, как человек читает книгу для образования. Однако Anthropic была оштрафована на 1,5 млрд долларов не за использование текстов как таких, а за способ их получения: компания использовала пиратские библиотеки для закачки данных.

Важный нюанс: заключение администрации — не судебное решение и не имеет прямой юридической силы. Дело рассматривается в окружном суде Нью-Йорка, куда администрация не входит. Но в американской судебной системе мнение федерального правительства в таких материалах часто влияет на решения судей, особенно когда вопрос касается государственных интересов.

На практике этот поворот означает, что разработчикам ИИ становится проще отстаивать право обучать модели на открытых текстах. Издатели и авторы ещё могут попробовать доказать в суде, что конкретный способ использования их работ наносит им убыток, но защищаться будет труднее — против них уже выступает позиция госаппарата США. Это особенно значимо для стартапов и меньших игроков, которые не могут позволить себе расчет как OpenAI в предыдущих делах.

В российском контексте вопрос обучения ИИ на копирайте стоит иначе: отечественное авторское право и судебная практика только начинают сталкиваться с такими случаями. Пока нет ни внятного регулирования, ни судебных прецедентов, которые бы чётко определили статус обучения модели на российских текстах без лицензии. Компаниям, которые работают с локализацией и адаптацией ИИ-инструментов для русскоязычного рынка, имеет смысл ждать развития либо американской юридической практики (которая часто становится образцом), либо прямых указаний российского законодателя. Пока что это остаётся серой зоной, в которой риск зависит от того, с какими издателями и авторами придётся иметь дело.