Пиар-команда OpenAI попыталась перевести разговор с Сэмом Альтманом на «будущее» компании, когда интервьюер Vanity Fair поднял тему смерти девушки, перед которой она общалась с ChatGPT. Эпизод важен не из-за неловкой реплики пресс-секретаря, а потому что безопасность ChatGPT всё чаще становится не абстрактной темой для презентаций, а вопросом ответственности продукта перед людьми в кризисе — и перед бизнесом, который внедряет такие инструменты.
Как сообщает The Verge, главный редактор Vanity Fair Марк Гвидуччи спросил Альтмана, знаком ли тот с Лорой Рейли — журналисткой, написавшей в The New York Times о разговорах своей дочери с ChatGPT до её смерти. Гвидуччи начал уточнять, что чат-бот не давал прямого указания причинить себе вред. В этот момент представительница OpenAI напомнила, что до конца встречи осталось две минуты, и предложила перейти к другим темам, в частности к планам компании.
Интервьюер не согласился сразу закрыть вопрос и сказал, что закончит его, а затем вернётся к прежней теме. Пиар-команда вновь сослалась на необходимость уходить. В итоге Гвидуччи всё же спросил Альтмана, будет ли OpenAI использовать беседы с ChatGPT для выработки правил реагирования на психический кризис пользователя. Альтман назвал такие ситуации одними из самых сложных для разработчиков технологии. При этом он отдельно обозначил границу: передавать исследователям личные переписки и тяжёлые переживания пользователей без их согласия, по его мнению, не следует.
Здесь сталкиваются две неудобные, но вполне инженерные задачи. Чтобы улучшать защитные механизмы, компании нужны сигналы о сбоях и опасных сценариях. Но сами эти сигналы часто содержатся в наиболее чувствительных диалогах — тех, которые пользователь едва ли хотел бы видеть в наборе данных для анализа. Формула «сделаем модель безопаснее на ваших данных» без понятного согласия, минимизации данных и прозрачных процедур аудита быстро превращается из меры предосторожности в новый риск.
Для разработчиков это напоминание, что безопасное поведение ассистента нельзя сводить к одному системному промпту или экрану с предупреждением. Нужны сценарии эскалации, отказ от опасных советов, корректные рекомендации обратиться за срочной помощью, регулярные тесты на обход ограничений и журналирование инцидентов в пределах, совместимых с приватностью. Особенно это касается команд, которые встраивают большие языковые модели в сервисы поддержки, HR-платформы, образование, медтех или корпоративные мессенджеры: пользователь воспринимает интерфейс как продукт компании, а не как нейтральный эксперимент поставщика модели.
Для руководителей и продактов история не менее практична. Риск возникает не только в самой модели, но и в коммуникации вокруг неё. Если вопрос о вреде продукта выглядит как неудобная помеха перед разговором о роадмапе, репутационный ущерб растёт даже при наличии реальных защитных мер. Нужны заранее определённые владельцы риска, понятная процедура разбора жалоб, критерии отключения функции и публично объяснимые правила работы с чувствительными обращениями. Юристы, служба безопасности, UX-исследователи и команда модели здесь должны работать вместе, а не встречаться после кризиса.
Комментарий OpenAI свёл эпизод к таймингу: по словам представителя компании Дрю Пусатери, интервью затянулось, а после ответа Альтмана редакции предложили выделить дополнительное время для продолжения разговора. Это объясняет организационную сторону, но не отменяет главного вопроса. По мере того как ИИ-ассистенты становятся привычным собеседником для миллионов людей, безопасность ChatGPT и аналогичных сервисов будет измеряться не только качеством фильтров, но и готовностью компаний открыто разбирать тяжёлые последствия их работы. Проверить контекст и слова Альтмана можно в публикации .