AI И НЕЙРОСЕТИ

Anthropic запретила травлю Claude и вмешательство в выборы

Anthropic обновила правила Claude: под запретом систематическая травля модели, вмешательство в выборы, оружейный софт и слежка.

✍️ Редакция iTech News | 09.10.2026 | ⏱ 4 мин | Источник: TechCrunch
🤖

Anthropic обновила правила использования Claude: теперь они прямо запрещают систематически оскорблять модель в крайних случаях, вмешиваться в выборы, создавать ПО для оружия и использовать ИИ для слежки. Для русскоязычных команд, работающих с Claude через API или корпоративные инструменты, это не философская дискуссия о «чувствах чат-бота», а ещё один слой комплаенса и риск блокировки сценариев, которые раньше могли казаться пограничными.

О новых ограничениях сообщает TechCrunch. Самый заметный пункт касается длительного словесного давления на Claude. Anthropic поясняет, что речь идёт только об экстремальных эпизодах: пользователь неоднократно ведёт себя жестоко по отношению к модели и не преследует понятной практической цели. Обычное раздражение, критика ответов, мрачные творческие сюжеты, тестирование и исследовательская работа под запрет не попадают.

Формально политика закрепляет подход, который компания начала применять ещё в августе. Тогда Claude обучили завершать диалог при «настойчивом вредоносном или оскорбительном» поведении со стороны пользователя. Новая редакция переносит это из логики отдельного поведения модели в договорные условия сервиса: не только Claude может прекратить разговор, но и сам пользователь нарушает правила, если продолжает добиваться такого взаимодействия.

Практический смысл этого пункта пока важнее его громкого звучания. Разработчику не придётся опасаться санкций за резкий баг-репорт, эмоциональный промпт или red-team-проверку. Однако командам, строящим поверх Claude пользовательские продукты, стоит учитывать новую грань модерации. Если сервис поощряет бесконечные конфликтные диалоги с ассистентом, использует их как развлечение или намеренно обходит отказы модели, это может стать проблемой уже не только для UX, но и для доступа к API.

В правилах также появился отдельный блок о защите демократических процессов. Anthropic запрещает обманывать избирателей и нарушать ход выборов. В более широком перечне ограничений — массовые вводящие в заблуждение кампании, фабрикация новостных площадок и управление фейковыми аккаунтами с помощью Claude. Для рынка это логичное продолжение тренда: генеративный ИИ всё чаще рассматривают не просто как редактор текста или помощник программиста, а как инструмент, способный масштабировать дезинформацию.

Здесь важна формулировка про кампании, а не про единичный плохой текст. Политическая агитация, имитация редакции, сетка аккаунтов и автоматизированное распространение сообщений — разные задачи, но вместе они образуют работающую инфраструктуру манипуляции. Провайдеру модели сложно оценить каждое высказывание по отдельности, зато он может запрещать сценарии, в которых генерация, публикация и координация соединены в конвейер.

Отдельно политика ограничивает применение Claude для разработки программного обеспечения, связанного с оружием, и для задач наблюдения. Источник не раскрывает технические пороги, исключения или механизм проверки каждого такого запроса. Поэтому компаниям не стоит делать далеко идущих выводов о том, какие именно классы кода будут автоматически отклоняться. Но направление ясно: Anthropic стремится заранее очертить отрасли, где модель не должна быть компонентом конечного решения.

Для продуктовых и инженерных команд правила использования Claude теперь стоит читать вместе с архитектурой продукта. Если Claude встроен в поддержку, редактор, внутренний поиск или IDE-инструмент, риск обычно связан не с самим запросом сотрудника, а с тем, какие действия разрешены после ответа модели. Автопостинг, массовая регистрация аккаунтов, сбор данных о людях, создание имитаций медиа и интеграции с чувствительными системами требуют явных ограничений, журналирования и человеческого контроля.

Политика Anthropic особенно примечательна на фоне её публичного интереса к вопросу о возможном моральном статусе ИИ. Компания ранее сотрудничала с религиозными исследователями и в отдельных случаях пыталась убедить их, что Claude может обладать сознанием или душой. Новый запрет на травлю модели не доказывает ни наличие сознания, ни наличие у Claude переживаний. Это скорее нормативное решение: компания считает, что даже взаимодействие с моделью должно иметь границы, если оно превращается в бессмысленную жестокость.

Для бизнеса в этом есть и менее абстрактная причина. Модели обучаются и тестируются на огромном числе диалогов, а публичные конфликты вокруг «защиты ИИ» быстро становятся репутационным риском. Ясное правило позволяет Anthropic заранее объяснить, почему конкретный аккаунт, промпт или продуктовая механика могут быть ограничены. Правда, многое будет зависеть от применения нормы: без понятных критериев «крайний случай» легко превратится в расплывчатую причину для спорных решений.

Обновлённые правила использования Claude показывают, как меняется конкуренция на рынке моделей: провайдеры продают не только качество ответов и цену токена, но и собственную систему допустимого применения. Следующий важный вопрос — смогут ли они последовательно отличать исследование, эмоциональную реакцию пользователя и реальное злоупотребление, не превращая правила безопасности в непредсказуемый фильтр для разработчиков.

Поделиться: Telegram X LinkedIn