Американские власти потребовали от Anthropic немедленно отключить доступ к Claude Fable 5 и Claude Mythos 5 для всех пользователей по всему миру. Для рынка это редкий и неприятный прецедент: самые мощные модели Anthropic сняли не из-за падения сервиса или бага в проде, а из-за претензий государства к рискам обхода защит.
По данным TechCrunch, распоряжение компания получила в пятницу в 17:21 по восточному времени США и сразу исполнила его. Формально речь идет об экспортном контроле и ограничении доступа для иностранных граждан, но на практике Anthropic пришлось выключить обе модели целиком, а не только для отдельной категории пользователей. Другие модели компании под запрет не попали.
История особенно болезненна для самой Anthropic, потому что Mythos 5 компания долго держала на коротком поводке именно из соображений безопасности. В начале апреля модель показали в превью и почти сразу спрятали в закрытую программу Project Glasswing. В нее допустили около 50 проверенных организаций, среди которых Amazon, Apple, Google, Microsoft и CrowdStrike. Логика была простой: Mythos 5 слишком хорош в поиске уязвимостей, чтобы выпускать его в свободный доступ без оглядки. По словам самой Anthropic, модель находила слабые места во всех крупных операционных системах и браузерах, которые ей давали на анализ.
Затем компания попыталась сделать коммерчески приемлемую версию этого же класса. Claude Fable 5 вышла всего за три дня до запрета и позиционировалась как вариант Mythos 5 с дополнительными ограничителями. Anthropic утверждала, что встроила guardrails, блокирующие ответы в зонах повышенного риска, включая кибербезопасность и биологию. То есть рынок получил не «обрезок», а публичную версию очень сильной модели, которой поставили намордник на самые чувствительные сценарии. По бенчмаркам Vals AI это была самая способная публично доступная модель на тот момент.
Почему регулятор вмешался именно сейчас
По версии Anthropic, претензия властей завязана на возможный jailbreak Claude Fable 5. Компания пишет, что пока услышала лишь устное описание «потенциального узкого, неуниверсального jailbreak-сценария». Если перевести этот оборот с корпоративного на человеческий язык, то речь идет не о тотальном взломе защиты, а о частном способе заставить модель проанализировать конкретную кодовую базу и указать на уязвимости. Anthropic отдельно подчеркивает: похожий уровень возможностей уже доступен в других открыто предлагаемых моделях, включая GPT-5.5 от OpenAI, а для defensive security такие сценарии вообще давно стали рабочим инструментом.
Это ключевой нерв всей истории. Когда AI-компания говорит: «Наша модель настолько опасна, что мы сами ограничиваем к ней доступ», она одновременно пытается заработать репутацию ответственного игрока и продает рынку ощущение технологического превосходства. Пока речь идет о переговорах с корпорациями и регуляторами, схема работает. Но как только в дело вступает государство, та же риторика начинает жить своей жизнью. Если вы месяцами объясняли, что у вас почти цифровой кибер-реактор, не стоит удивляться, что чиновники захотят посмотреть на рубильник.
Anthropic с этим выводом явно не согласна. Компания настаивает, что основные защитные механизмы Fable 5 работают не только на уровне самой модели, но и через независимые классификаторы. Иными словами, даже если пользователь продавит модель в разговоре дальше обычного отказа, самые опасные типы ответов все равно должны быть отсечены внешней системой контроля. В своем заявлении Anthropic прямо спорит с решением властей и пишет, что обнаружение узкого потенциального jailbreak не должно становиться основанием для отзыва коммерческой модели, которой уже пользуются сотни миллионов людей. Это важная формулировка: компания фактически предупреждает, что если такой стандарт закрепится, у frontier-провайдеров начнутся системные проблемы с любым новым релизом.
Почему эта история важна не только для Anthropic
Для разработчиков и продуктовых команд здесь сразу несколько неприятных сигналов. Первый: даже если модель доступна через официальный API или публичный продукт, ее жизненный цикл теперь сильнее зависит не только от багов и коммерции, но и от экспортного контроля, оценки рисков и аппаратных решений регуляторов. Второй: guardrails перестают быть просто технической темой. Раньше спорили о том, не слишком ли они мешают полезным сценариям. Теперь выясняется, что даже наличие guardrails не гарантирует модели иммунитет от резкого отключения. Если государство считает риск значимым, объяснение про «защиты на отдельном слое» может не сработать.
Для бизнеса вывод еще жестче. Если компания строит продукт на одной передовой модели, особенно в чувствительных сегментах вроде AppSec, code review, анализа инфраструктуры или threat intelligence, ей нужен план на случай внезапного исчезновения поставщика. Мультивендорность в AI долго звучала как скучная презентационная мантра, но такие кейсы быстро делают ее нормой. Когда модель могут выключить в пятницу вечером по решению регулятора, архитектурный запасной выход перестает быть роскошью. Он становится вопросом выживания сервиса и соблюдения SLA.
Есть и более широкий отраслевой эффект. Anthropic давно строила образ «самого осторожного взрослого в комнате» на фоне конкурентов, которые якобы двигаются быстрее и менее аккуратно. В этом была и этика, и маркетинг. Ирония в том, что именно эта осторожность, судя по всему, привлекла к Mythos 5 максимум внимания. Сэм Альтман еще в апреле язвительно называл подход Anthropic «маркетингом через страх» и сравнивал его с логикой «мы построили бомбу, а теперь готовы продать вам бомбоубежище». Тогда это звучало как обычная пикировка двух лагерей перед вероятными IPO. Теперь реплика выглядит менее шутливой: если компания сама долго рассказывает рынку, насколько опасен ее продукт, эти слова вполне могут использовать против нее.
Следующий вопрос для всей индустрии звучит уже не как философия, а как операционная политика: где проходит граница между полезной моделью для defensive security и моделью, которую государство сочтет слишком рискованной для широкого доступа. Пока на этот вопрос нет прозрачного и публичного ответа, любой поставщик сильных AI-систем для кода, инфраструктуры и кибербеза работает с новым типом риска: сначала ты выигрываешь гонку мощностью, а потом доказываешь, что твоя собственная презентация не была обвинительным заключением.