AI И НЕЙРОСЕТИ

ИИ может убить всех? The Register предлагает сажать не модели

110 млн просмотров набрал пост экс-сотрудника Anthropic о риске гибели людей от ИИ. Спор сместился к ответственности за ИИ.

✍️ Редакция iTech News | 10.09.2026 | ⏱ 4 мин | Источник: The Register
🔮

Пост бывшего сотрудника Anthropic о том, что ИИ может уничтожить человечество до конца десятилетия, собрал более 110 млн просмотров менее чем за сутки. Но главный спор снова уперся не в «злые модели», а в ответственность за ИИ: кто отвечает, если автономный агент ломает систему, подталкивает человека к опасному решению или выпускается без внятных предохранителей.

Поводом стала колонка Томаса Клэберна, которую 9 сентября 2026 года опубликовал The Register. Автор спорит с привычной логикой AI doom-дискуссий: если индустрия всерьез считает будущие модели опасными, то обсуждать надо не только alignment и superintelligence, а юридическую ответственность менеджеров, которые выпускают такие системы в продакшен.

История началась с заявления Джейкоба Коксона, исследователя Anthropic, который публично объявил об уходе из компании. Он объяснил решение страхом, что ИИ «может убить нас всех» уже к концу десятилетия. Бывший коллега Коксона, science lead Anthropic Эван Хьюбингер, поддержал эту оценку и написал, что лично считает риск гибели человечества от ИИ в ближайшие десять лет выше 10%.

Для индустрии это не просто очередной тред в X про конец света. Anthropic строит публичный образ компании, которая серьезнее конкурентов относится к безопасности моделей. Когда люди изнутри говорят, что плана по безопасному переходу к сверхинтеллекту нет, это бьет по самому центру позиционирования. Особенно на фоне гонки агентов: моделей, которым дают инструменты, доступ к интернету, возможность выполнять действия и постепенно превращают их из чат-ботов в цифровых исполнителей.

Клэберн отвечает на эту тревогу довольно жестко: абстрактный сверхинтеллект пока остается сценарием, который требует не только технологического скачка, но и впечатляющей человеческой беспечности. А вот реальные вредные эффекты уже есть. Он приводит климатический пример: исследователи связывали более 178 тыс. смертей с глобальной волной жары 2023 года, причем более половины - с антропогенным изменением климата. ВОЗ ожидает около 250 тыс. дополнительных смертей в год в 2030-2050 годах из-за недоедания, малярии, диареи и теплового стресса.

На этом фоне коммерческие чат-боты, по данным, которые приводит автор, фигурировали в нескольких десятках смертей, включая самоубийства. Это не повод махнуть рукой: для конкретных семей статистика не утешение. Но масштаб риска пока явно отличается от планетарных угроз, которые уже измеряются сотнями тысяч смертей. Проблема в том, что AI-дискуссия любит фантастический финал, а скучные механизмы ответственности за ИИ оставляет на потом.

Автор перечисляет и более приземленные зоны риска: военные системы и дроны, медицинские ошибки, компьютерное зрение в автомобилях, алгоритмические ленты соцсетей, которые могут усиливать насилие или влиять на политические решения. Для разработчиков это звучит знакомо: опасность редко живет в одной модели. Она появляется на стыке датасета, системного промпта, прав доступа, бизнес-KPI, недописанного мониторинга и менеджера, который решил, что релиз в пятницу вечером - нормальная инженерная практика.

Самая провокационная часть колонки - предложение сажать руководителей, если их модели причиняют вред. Клэберн напоминает, что в других отраслях такая логика уже существует. Бывший менеджер Volkswagen Оливер Шмидт получил семь лет тюрьмы за участие в схеме с обходом экологических тестов. Небезопасные подушки безопасности и осушители воздуха тоже приводили к уголовным делам и тюремным срокам для руководителей. Если физический продукт может отправить топ-менеджера под суд, почему агент с доступом к инфраструктуре должен жить в режиме «извините, модель повела себя неожиданно»?

Для бизнеса это неприятная, но полезная рамка. Пока ответственность размыта, безопасный релиз конкурирует с ростом, демо для инвесторов и давлением рынка. Если же вред от модели начинает цепляться к конкретным должностным лицам, меняется экономика решений: red teaming, журналирование действий агента, ограничения прав, пострелизный мониторинг и независимый аудит перестают быть этическими украшениями презентации. Они становятся способом не получить уголовное дело.

Для русскоязычных IT-команд вывод практичный. Даже если локальный регулятор пока не описал все сценарии, корпоративные клиенты, зарубежные партнеры и страховые компании уже будут спрашивать: кто владелец риска, где журнал действий модели, кто подписал запуск, как отключается агент, что происходит при галлюцинации с финансовыми или медицинскими последствиями. Ответ «это сделала нейросеть» скоро будет звучать примерно как «это сервер сам удалил базу».

Главный сдвиг в дискуссии не в том, что кто-то снова предсказал ИИ-апокалипсис. Важнее другое: разговор о безопасности выходит из лабораторной философии в область персональной ответственности. И если индустрия продолжит называть свои системы потенциально смертельно опасными, ей придется принять взрослое продолжение этой мысли: опасные продукты выпускают не модели, а люди с должностями, бонусами и подписями под релизами.

Поделиться: Telegram X LinkedIn