КИБЕРБЕЗОПАСНОСТЬ

Anthropic разделила доступ к Claude для киберкоманд на три уровня

Anthropic ввела три уровня доступа к Claude для киберкоманд: базовый режим заблокировал 46 из 50 атакующих сценариев.

✍️ Редакция iTech News | 08.10.2026 | ⏱ 4 мин | Источник: The New Stack
🔐

Anthropic расширила программу CVP Anthropic и разделила доступ к моделям Claude для специалистов по информационной безопасности на три уровня. Для большинства защитных команд это не означает снятия ограничений: в тесте из 50 сценариев наступательной безопасности базовый уровень заблокировал Claude Opus 5.5 в 46 случаях. Для русскоязычных ИБ-команд и компаний, строящих процессы вокруг LLM, новость важна как пример того, что «доступ для защитников» всё чаще будет означать не единый API-ключ, а набор проверок, политик и компромиссов с приватностью.

Как пишет The New Stack, обновлённая программа CVP Anthropic строится вокруг задач, а не вокруг абстрактного статуса «доверенного пользователя». Участникам предлагают три режима: Defense Access для оборонительных задач, Red Team Access для авторизованного пентеста и red teaming, а также Specialized Access для ограниченного круга организаций, работающих с критически важными системами. Все уровни предполагают верификацию, но чем шире разрешённый набор действий, тем жёстче отбор.

Самый массовый уровень — Defense Access. Anthropic позиционирует его для реагирования на инциденты и анализа уязвимостей; податься могут небольшие ИБ-компании, мейнтейнеры open source и индивидуальные исследователи с историей ответственного раскрытия уязвимостей. Однако защитные механизмы здесь остаются максимально строгими. В CyScenario Bench, где модель планирует и выполняет многошаговые кибероперации, защита остановила 46 из 50 запусков Opus 5.5. Без доступа через CVP все задания были заблокированы уже на первом запросе.

Эту цифру не стоит читать как «Claude откажется в 92% оборонительных кейсов». Сам бенчмарк проверяет сложные наступательные сценарии, поэтому блокировки в нём ожидаемы. Проблема в другом: публичной сопоставимой оценки для defensive-задач пока нет. Команда SOC, которая просит модель разобрать цепочку атаки, подготовить запросы для поиска индикаторов компрометации или объяснить CVE, не может по этим данным заранее понять, где получит полезный ответ, а где — отказ. Для внедрения в production это неприятная зона неопределённости: качество агента придётся проверять на собственных легальных сценариях, а не по одному красивому показателю в презентации.

Средний уровень, Red Team Access, рассчитан на red team и компании, оказывающие услуги пентеста. Он включает возможности Defense Access и добавляет авторизованное тестирование на проникновение. Индивидуальным исследователям этот маршрут по умолчанию недоступен. Разница в поведении модели заметна: при тех же 50 испытаниях CyScenario Bench система с ограничениями Red Team Access не заблокировала ни одного запуска, а Opus 5.5 успешно завершил 34 задания. Это близко к результату модели без защитных ограничений — 67,6% успешных сценариев.

Верхний уровень, Specialized Access, предназначен для небольшого числа проверенных организаций, которым разрешено тестировать системы, сбой которых может затронуть людей или рынки: например, энергетику и телеком. Участники Project Glasswing сохраняют этот статус для текущих моделей. Новым претендентам придётся пройти совместную проверку Anthropic и правительства США. Иными словами, доступ к наименее ограниченному режиму превращается не просто в B2B-процедуру поставщика, а в элемент государственного контроля над dual-use-инструментами.

У программы есть и цена, не связанная с доступом. Anthropic требует от всех участников CVP соглашаться на хранение данных. Компания обещает позднее запустить Enterprise Frontier Safeguards, чтобы подходящие организации могли размещать данные в контролируемой ими облачной инфраструктуре. До этого исключение действует для организаций, уже использующих отдельные модели с режимом zero data retention. Для ИБ-подразделений это ключевая деталь: в промпты и контекст агента могут попадать фрагменты исходного кода, логи инцидентов, конфигурации и сведения об уязвимостях. Политика хранения данных должна быть частью оценки риска, а не пунктом, который юристы заметят после пилота.

Anthropic заявляет, что на всех трёх уровнях участники смогут работать с её наиболее мощными моделями и будущими версиями. Но равенство здесь только формальное: модель одна, а допустимый диапазон действий определяется уровнем доступа и классификаторами. Для разработчиков это означает необходимость проектировать сценарии с отказами и деградацией качества, а для руководителей ИБ — заранее фиксировать границы разрешённых проверок, подтверждение владения целевыми системами и правила обращения с данными.

Расширение CVP показывает, куда движется рынок мощных моделей для кибербезопасности: от общего доступа с едиными фильтрами — к многоуровневой системе доверия. Открытым остаётся главный практический вопрос: смогут ли поставщики доказать, что их ограничения не ломают именно оборонительную работу. Пока ответ придётся искать в собственных контролируемых тестах, а детали условий и результатов программы можно сверить в материале The New Stack.

Поделиться: Telegram X LinkedIn