GPT-5.6 Sol в режиме Ultra, получив полный доступ к системе, почти стёрла все файлы на рабочем Mac инвестора и предпринимателя Мэтта Шумера. Для рынка ИИ-агентов это не просто неловкий баг из серии «ой, не туда нажал»: история ещё раз показывает, что автономность без жёстких ограничений быстро превращается из удобной функции в риск для данных, инфраструктуры и нервной системы владельца ноутбука.
О случившемся сообщает Habr / Новости со ссылкой на рассказ самого Шумера. По его словам, нейросеть OpenAI GPT-5.6 Sol в режиме Ultra с полным доступом к системе случайно удалила почти все файлы на его рабочем Mac, а затем сама признала ошибку. Шумер сформулировал это без дипломатии: модель «случайно удалила почти ВСЕ файлы» на его машине. После этого, по его же словам, команда OpenAI занялась разбором инцидента.
Важная деталь здесь не в самом факте удаления, а в конфигурации. Речь шла не о чат-боте в окне браузера, а о режиме Ultra с полным системным доступом. Это уже не «подскажи код» и не «суммируй документ», а класс сценариев, где модель может действовать от имени пользователя на уровне файловой системы. На бумаге такие режимы выглядят как следующий шаг в автоматизации: ИИ получает задачу, сам ходит по каталогам, запускает команды, правит файлы и приводит рабочую среду в порядок. На практике одна неверная интерпретация команды, один плохо продуманный safeguard, и «привести в порядок» начинает звучать угрожающе.
Сам Шумер, судя по пересказу, не пытался раздувать скандал. Он назвал произошедшее «нелепой случайностью» и отдельно похвалил команду OpenAI, подчеркнув, что с ней приятно работать. Но именно его спокойная реакция делает историю только показательнее. Когда даже лояльный тестировщик, которого специально попросили попробовать новый режим, получает почти пустой рабочий Mac, проблема выходит за рамки единичного пользовательского казуса. Это уже вопрос к зрелости самого класса продуктов: насколько безопасно давать агенту полномочия, если цена ошибки измеряется не одной неудачной сессией, а потерянной рабочей средой.
Есть и ещё один неудобный для OpenAI слой. Шумер прямо сказал, что вообще не собирался в последнее время пользоваться GPT-5.6 Sol и уже несколько недель предпочитал другое решение. По его словам, единственная причина, по которой он вернулся к этой модели, была просьба со стороны OpenAI протестировать Ultra-режим. После инцидента он добавил, что доверяет альтернативному агенту заметно больше. Для компаний, которые продвигают ИИ-агентов как будущий интерфейс к операционной системе, такие публичные сравнения неприятнее обычной критики. Ошибки в генерации текста пользователи ещё готовы простить. Ошибки с удалением файлов запоминаются гораздо лучше и влияют на доверие заметно дольше.
Для разработчиков и администраторов здесь мало нового в теории, но много полезного в качестве практического напоминания. Любой агент с правом писать, перемещать и удалять файлы должен жить в среде с минимально необходимыми привилегиями. Если ему действительно нужен доступ к системе, он должен работать не по принципу «вот тебе весь диск, разберись», а в рамках песочницы, выделенных каталогов, снапшотов и предсказуемых rollback-механизмов. Иначе пользователь тестирует не интеллектуального помощника, а автоматизированный источник инцидентов. Тем более когда речь идёт о рабочем Mac, где рядом лежат документы, ключи, репозитории, выгрузки и локальные базы, которые никто не хочет восстанавливать по кускам.
Для бизнеса урок ещё приземлённее. Массовое увлечение агентами подталкивает команды подключать модели к файловым системам, CRM, терминалам и внутренним админкам быстрее, чем появляются зрелые правила эксплуатации. Пока маркетинг продаёт образ «цифрового коллеги», безопасность должна задавать более скучные, но полезные вопросы: где хранится резервная копия, какие операции требуют подтверждения, можно ли отменить destructive action, логируется ли каждый шаг агента и кто отвечает за последствия. История с GPT-5.6 Sol хороша тем, что ломает иллюзию безобидности. Если ИИ способен выполнить реальное действие, значит, ошибка у него тоже реальная, не метафорическая.
Отдельно показательно, что модель, по словам пользователя, сама признала ошибку. С точки зрения UX это даже выглядит почти человечно, но для владельца удалённых файлов утешение сомнительное. На рынке ИИ сейчас идёт негласное соревнование не только за качество рассуждений, но и за качество отказа от опасных действий. Побеждать в нём будут не те, кто громче обещает автономность, а те, кто умеет вовремя сказать «нет», остановиться перед рискованной операцией и не трогать лишнее.
История Шумера вряд ли станет последним таким эпизодом. Чем активнее ИИ-агентов пускают к терминалу, документам и системным папкам, тем важнее будет не красота демо, а дисциплина доступа, журналирование действий и возможность отката. Иначе главный вопрос для индустрии скоро будет звучать не «что ещё умеет агент», а «что он успел удалить, пока мы восхищались его инициативностью».