Seattle Times и Newsday подали коллективный иск против OpenAI и Microsoft, присоединившись к растущему числу медиаорганизаций, атакующих разработчиков ИИ. Главный аргумент исков остаётся неизменным: журналистский контент использовался для обучения моделей без разрешения и без компенсации, при этом сами ИИ-системы способны генерировать тексты, конкурирующие с оригинальной журналистикой.

Формулировки в иске особенно выразительны: стороны описывают ChatGPT и Copilot как «алчных потребителей», пожирающих человеческий контент и выплёвывающих обратно его копии и производные версии. Журналисты опасаются, что без защиты авторских прав индустрия медиа может быть «разрушена до неремонтопригодного состояния» — риск реальный, учитывая, что на фоне разорения местных редакций профессиональная журналистика уже находится под серьёзным давлением.

Волна исков началась в конце 2023 года с New York Times, позже к ним присоединились другие издания. Seattle Times заслуживает особого внимания именно потому, что Microsoft и OpenAI вкладывали средства в её проекты и стипендиальные программы — это создаёт ироничную ситуацию, когда финансирующая сторона одновременно обвиняется в воровстве контента.

Microsoft пока реагирует миролюбиво, заявляя через спикера, что компания готова обсуждать способы разрешения спора. Это стандартный PR-ход в условиях множественных судебных разбирательств, но по сути означает одно: компания ещё не убеждена, что проигрывает по существу, и хочет договориться до рассмотрения в суде, если условия будут выгодны.

Вопрос авторского права в контексте обучения моделей остаётся технически и юридически запутанным. Индустрия настаивает, что использование контента для ML — это справедливое использование (fair use), медиа говорят о прямом копировании и коммерческой эксплуатации. Судьба этих исков определит, сколько стоит контент медиа для ИИ-компаний: ничего (как сейчас), или потребуется лицензирование и платежи авторам и издателям.

Практически это означает, что крупные ИИ-платформы могут вынуждены либо ограничить обучение на защищённом контенте, либо договариваться о лицензировании. Уже видны попытки первого подхода — некоторые издатели получают возможность исключить свой контент из индексов ИИ-моделей, хотя это работает неоднородно.

Для российского медиабизнеса ситуация менее критична просто потому, что большинство локальных изданий пока не производят объём контента, привлекательный для масштабного обучения моделей на русском языке. Однако растущая локализация моделей означает, что с развитием российского рынка ИИ этот вопрос неизбежно встанет и перед отечественными редакциями. Стоит следить, как разрешится американский судебный кейс — его прецеденты повлияют на переговоры и между российскими издателями и разработчиками ИИ-сервисов.