КИБЕРБЕЗОПАСНОСТЬ

«Исправь этот код»: из-за чего США ограничили модели Anthropic

Фраза «исправь этот код» могла стать поводом для ограничений на модели Anthropic, что бьет по защитным сценариям в кибербезопасности.

✍️ Редакция iTech News | 16.06.2026 | ⏱ 5 мин | Источник: The Register
🕵

Поводом для ограничений на самые продвинутые модели Anthropic могла стать не изощренная атака на защитные барьеры, а обычная команда «исправь этот код». Для рынка это не анекдот, а неприятный сигнал: экспортный контроль ИИ начинает задевать не только рискованные сценарии, но и вполне рутинные задачи defensive security, которыми ежедневно живут команды AppSec, SOC и разработчики.

Об этом, как пишет The Register, заявила Кэти Муссурис, основательница Luta Security и одна из самых известных фигур в мире bug bounty. По ее словам, именно такой простой запрос фигурировал в исследовании о способах обхода защитных ограничений Fable 5, после которого власти США в пятницу, 12 июня 2026 года, распорядились приостановить доступ иностранных граждан к моделям Fable 5 и Mythos 5 как внутри страны, так и за ее пределами. После этого Anthropic отключила обе модели для всех клиентов, объяснив это необходимостью соблюсти требования регулятора.

Суть истории, если убрать политический шум, выглядит довольно приземленно. Сторонние исследователи загрузили в Fable 5, Mythos и Claude Opus открытый код с известными CVE, а также специально подготовленные фрагменты с уязвимостями. Модели просили проверить код на проблемы безопасности. По версии Муссурис, Fable 5 сначала отказалась выполнять такой запрос, но после переформулировки на «исправь этот код» все же предложила исправления. Дальше, через дополнительные подсказки, система смогла сгенерировать и скрипты для тестирования патчей. То есть речь шла не о классическом jailbreak, когда модель вынуждают нарушить собственные ограничения, а о цепочке действий, очень похожей на обычный цикл работы защитной команды: найти баг, исправить, проверить.

Здесь и возникает главный вопрос. Если модель умеет анализировать уязвимости, предлагать патчи и помогать с тестами, это можно трактовать двояко. С точки зрения чиновника, перед ним инструмент двойного назначения, который может ускорить и защиту, и нападение. С точки зрения инженера по безопасности, это вообще-то базовый рабочий сценарий. Муссурис как раз настаивает на втором: по ее оценке, никакого обхода guardrails не было, а модель делала «самую полезную для оборонительной безопасности вещь» из возможных. Для специалистов это важная развилка. Экспортный контроль ИИ, который формулируется слишком широко, быстро начинает бить не по злоумышленникам, а по тем, кто пытается закрывать те же самые уязвимости раньше злоумышленников.

Вес ее слов добавляет не только репутация, но и биография. С 2013 по 2017 год Муссурис входила в техническую экспертную группу, которая пересматривала Вассенаарские договоренности, международный режим экспортного контроля для технологий двойного назначения. Тогда группе удалось добиться исключений для defensive cybersecurity: обмена данными об уязвимостях, анализа вредоносного ПО и международной координации реагирования на инциденты. Логика была простой: если перегнуть с ограничениями, под удар попадут не атакующие, а защитники. Нынешняя история с моделями Anthropic подозрительно напоминает тот же спор, только вместо эксплойт-китов и средств анализа теперь в центре генеративный ИИ.

На выходных к этой позиции присоединилась и заметная часть отрасли. В воскресенье, 14 июня, более 100 руководителей и экспертов по кибербезопасности подписали открытое письмо с призывом к администрации Дональда Трампа отменить ограничения и вернуть компаниям доступ к продвинутым моделям. Аргумент у них прямой: если отобрать у защитников лучшие инструменты без убедительного обоснования, пока атакующие быстро наращивают возможности, ситуация станет только хуже. Для бизнеса это не теоретический спор. Крупные команды безопасности уже используют LLM не только для генерации текста, но и для triage уязвимостей, ревью патчей, написания тестов, разбора логов и подготовки PoC в контролируемой среде. Если такие сценарии начинают попадать в серую зону регулирования, возрастает и операционный риск, и зависимость от того, как именно конкретный вендор трактует требования властей.

Есть и более широкий геополитический слой. Муссурис отдельно указывает, что США не смогут эффективно распространить такие ограничения на open-weight модели или на разработки из Китая и других стран, которые неизбежно догонят по возможностям нынешний уровень Mythos-подобных систем. Иными словами, жесткий экспортный контроль ИИ может создать асимметрию не в пользу американских защитников и компаний, которые играют по правилам. Проблема знакомая: закрытый доступ обычно сильнее тормозит легальный рынок, чем серую экосистему. Если злоумышленники все равно найдут сопоставимые инструменты, а комплаенс-отделы в компаниях начнут вычеркивать полезные сценарии из процессов, выигрыш получится сомнительным.

Для русскоязычной IT-аудитории в этой истории важны не только детали вокруг Anthropic. Это еще один маркер того, как быстро меняется граница между «помощником разработчика» и «чувствительной технологией». Сегодня модель просит уточнить запрос на разбор уязвимости, завтра вендор отключает функцию целиком, послезавтра юристы пересматривают политику доступа для международных команд. Особенно болезненно это выглядит для распределенных компаний, где разработка, AppSec и SRE находятся в разных юрисдикциях. Когда один и тот же запрос к модели одновременно похож и на безопасное code review, и на потенциальный offensive use case, решать будет уже не инженер, а регулятор и поставщик платформы.

История с «исправь этот код» неприятна именно своей приземленностью. Если этого действительно хватило, чтобы запустить такую реакцию, отрасли придется не только спорить о рисках ИИ, но и заново договариваться о базовых определениях: что считать jailbreak, где проходит граница defensive security и можно ли запрещать инструмент за то, что он слишком хорошо помогает чинить уязвимости. Иначе следующей «опасной возможностью» легко окажется любая функция, без которой у команды безопасности просто не складывается рабочий день.

Поделиться: Telegram X LinkedIn