Seattle Times и Newsday подали совместный иск против OpenAI и Microsoft: две американские медиакомпании утверждают, что их материалы использовали для обучения ИИ без разрешения. Для русскоязычной IT-аудитории это не очередная ссора юристов, а спор о том, на каких данных можно строить генеративные модели и кто в итоге заплатит за контент, которым эти модели питаются.
Иск был подан в пятницу, 4 сентября 2026 года, сообщает Engadget. В нем Seattle Times и Newsday обвиняют OpenAI и Microsoft в том, что компании якобы системно собирали новостные статьи, включая материалы за пейволлом, и использовали их при обучении ИИ-моделей. Истцы считают, что такая схема подрывает экономику редакций: пользователь получает краткий ответ от чат-бота, а не переходит на сайт издания, где работают подписки и реклама.
Отдельная претензия касается не только копирования, но и качества ответов. По версии медиакомпаний, ИИ-системы могут выдавать галлюцинации и приписывать ложные сведения Seattle Times или Newsday. Для редакций это токсичная комбинация: сначала их тексты помогают обучать модель, потом модель конкурирует с ними за внимание, а в худшем случае еще и портит репутацию, выдавая ошибку под чужим брендом.
В иске также говорится об удалении информации об управлении авторскими правами из статей. Это важная деталь для разработчиков и компаний, которые работают с корпусами текстов: спор давно вышел за рамки вопроса «можно ли скачать страницу из интернета». Речь идет о цепочке происхождения данных, лицензиях, метаданных, пейволлах и о том, можно ли доказать, что конкретный фрагмент попал в обучающую выборку законно.
Seattle Times и Newsday не первые, кто пошел по этому маршруту. В 2023 году The New York Times подала похожий иск против OpenAI и Microsoft, задав тон крупным медиасудам против AI-компаний. Ранее в 2026 году CNN судилась с Perplexity по претензиям об авторском праве. На другой стороне рынка — Associated Press и Vox Media: эти издатели выбрали не суд, а партнерство с OpenAI, разрешив использовать свои материалы на договорных условиях.
Для AI-компаний это неприятный, но ожидаемый фронт. Чем мощнее становятся модели, тем менее убедительно звучит позиция «мы просто учились на открытом вебе». Издатели смотрят на продуктовый результат: если модель пересказывает новость, отвечает на запрос пользователя и удерживает его внутри чужой платформы, то редакция теряет часть ценности, которую сама создала. Юридический вопрос здесь упирается в fair use, но бизнесовый вопрос проще: кто получает деньги за труд журналистов, редакторов и фактчекеров?
Для бизнеса, который внедряет генеративный ИИ, этот иск против OpenAI важен не меньше, чем для самих вендоров. Если суды начнут жестче трактовать использование защищенных данных, компаниям придется внимательнее смотреть на происхождение обучающих наборов, условия API, indemnity-клаузулы в контрактах и риски вывода защищенного текста в ответах моделей. Особенно это касается продуктов, которые работают с новостями, аналитикой, юридическими документами, медицинскими данными и другими дорогими текстовыми корпусами.
Разработчикам тоже есть о чем подумать. Простая интеграция LLM в поиск, саппорт или внутреннюю базу знаний уже не выглядит нейтральной технической задачей. Нужно логировать источники, хранить права на документы, ограничивать генерацию близких пересказов, добавлять цитирование там, где оно уместно, и понимать, какие данные вообще можно отправлять модели. Иначе риск переедет из юридического отдела прямо в архитектуру продукта.
Новый иск против OpenAI и Microsoft показывает, что рынок ИИ входит в стадию дорогостоящей инвентаризации данных. Одни медиа будут торговаться за лицензии, другие — судиться, третьи — закрывать доступ ботам и усиливать пейволлы. Для индустрии главный вопрос теперь не в том, нужны ли качественные тексты для обучения моделей, а в том, кто имеет право превращать чужую редакционную работу в инфраструктуру для собственного продукта.