Иск против Anthropic со стороны Sony Music Publishing, Warner Chappell и ряда других музыкальных издателей выглядит не как очередной спор о «добросовестном использовании», а как лобовая атака по самой болезненной теме генеративного ИИ: откуда вообще брались данные для обучения. Если претензии подтвердятся, для AI-компаний это плохой сигнал: суды могут смотреть не только на сам факт тренировки моделей на защищенном контенте, но и на способ добычи этого контента.
Иск подан поздно вечером в пятницу, 29 августа 2026 года, в окружной суд США по Северному округу Калифорнии, сообщает TechCrunch. Среди ответчиков указаны Anthropic и ее сооснователи Дарио Амодеи и Бенджамин Манн. Истцы утверждают, что компания вела «наглую кампанию» по незаконному торрентингу, скрейпингу и скачиванию защищенных авторским правом произведений, а затем использовала тысячи таких работ для обучения Claude. Формулировка для рынка вполне прозрачная: речь идет уже не о серой зоне вокруг обучения моделей, а о прямом обвинении в цифровом пиратстве.
На это стоит обратить внимание не только юристам и правообладателям. Для разработчиков и продуктовых команд спор важен потому, что он бьет по всей цепочке поставки данных. До сих пор многие обсуждали в первую очередь вопрос, можно ли обучать большие модели на защищенных текстах, музыке или изображениях без отдельной лицензии. Новый иск против Anthropic смещает акцент: даже если суд готов признать обучение модели на авторских материалах допустимым в каких-то рамках, незаконный способ получения этих материалов может стоить компании очень дорого. Это уже не философия про fair use, а вопрос базовой data governance, который неприятно слышать всем, кто привык относиться к датасетам как к чему-то «само нашлось в интернете».
Anthropic пока публично не комментировала иск. TechCrunch пишет, что на момент публикации изданию не удалось получить комментарий компании. Других подробностей пока немного, но и того, что есть, хватает: издатели обвиняют компанию в использовании не просто отдельных произведений, а тысяч защищенных работ. Причем в иске, по данным TechCrunch, фигурируют и книги, содержащие тексты песен и нотные записи. Для музыкального бизнеса это отдельный нерв. Если с песенными текстами и так все довольно очевидно, то упоминание sheet music показывает, что правообладатели целятся шире и хотят поставить под вопрос само масштабное копирование музыкального контента в корпусах для обучения.
Это не первый заход на Anthropic по линии интеллектуальной собственности. TechCrunch напоминает, что часть юристов, представляющих издателей в новом деле, уже работает в иске Concord Music Group и Universal Music Group, поданном в январе. Те же юристы участвовали и в деле Bartz v. Anthropic, где группа авторов обвиняла компанию в использовании защищенных работ при обучении продуктов вроде Claude. В том деле суд пришел к важному, хотя и неудобному для обеих сторон выводу: само использование защищенных произведений для обучения ИИ было признано законным, а вот получение контента через пиратские каналы — нет. По данным TechCrunch, в результате Anthropic обязали выплатить 1,5 млрд долларов. Для всей индустрии это, пожалуй, ключевой ориентир: суды начинают разделять вопрос «можно ли учить» и вопрос «как именно это было собрано».
Поэтому нынешний процесс выглядит особенно неприятно для Anthropic. Источник подчеркивает, что новый иск шире предыдущих и развивает уже знакомую линию обвинения. Если в ранних разбирательствах спор в основном вращался вокруг обучения Claude на защищенных произведениях, то теперь акцент поставлен на «вопиющее пиратство» и незаконный торрентинг ради получения миллионов копий книг. Для правообладателей это сильная стратегия: спор о fair use обычно быстро уходит в сложные правовые дебри, где каждая сторона может долго тянуть одеяло на себя. Обвинение в незаконном скачивании и массовом копировании звучит проще, жестче и понятнее для суда, прессы и потенциальных партнеров AI-компании.
Для бизнеса здесь есть еще один неприятный слой. Если претензии к происхождению данных становятся главным полем боя, под удар попадают не только разработчики фундаментальных моделей, но и все, кто строит продукты поверх них. Корпоративные заказчики уже задают поставщикам ИИ-сервисов вопросы о происхождении данных, лицензиях и рисках регрессных исков. После таких историй эти вопросы перестают быть формальностью для юридического отдела и превращаются в нормальную часть due diligence. И если раньше можно было отделаться общими фразами про «ответственный ИИ», то теперь нужны внятные ответы: откуда взяты данные, есть ли лицензии, какие источники исключены, как устроен аудит корпуса и что компания готова показать в суде или крупному клиенту.
Для русскоязычной IT-аудитории здесь урок вполне прикладной. Команда, которая собирает датасеты для поиска, рекомендаций, транскрибации, генерации текста или музыки, больше не может прятать происхождение контента за словом «скрейпинг». Если источники спорные, риск не исчезает только потому, что продукт делается не в Калифорнии и не выходит сразу на американский рынок. В экосистеме B2B-платформ, open-source-инструментов и международных интеграций история с данными быстро превращается из технической детали в барьер для продаж, инвестиций и партнерств. И в этом смысле иск против Anthropic важен не только для самой компании, но и для всей отрасли: рынок постепенно переходит от восторга по поводу возможностей моделей к очень скучному, но решающему вопросу о легальности сырья.
Следующий большой спор в генеративном ИИ, похоже, будет не о том, умеет ли модель писать, рисовать или сочинять музыку лучше человека, а о том, на каких именно массивах она этому научилась и кто за эти массивы в итоге заплатит. Для AI-компаний это означает конец эпохи, когда качество модели можно было обсуждать отдельно от происхождения данных.