Трое бывших исследователей OpenAI по безопасности ИИ публично оспорили причины своего увольнения и заявили, что оно создаёт внутри компании атмосферу страха. Для отрасли это не просто трудовой спор: безопасность ИИ OpenAI во многом зависит от того, могут ли специалисты обсуждать риски моделей с внешними аудиторами и руководством без опасения потерять работу.
Джасмин Ван, Томек Корбак и Микита Балесни были уволены на прошлой неделе. В открытом письме, адресованном комитету OpenAI по безопасности и защищённости, консультативной группе по безопасности и миссионному совету, они отвергли обвинения в ненадлежащем обращении с конфиденциальной информацией. Об их позиции сообщает TechCrunch.
OpenAI утверждает, что увольнению предшествовало внутреннее расследование, обнаружившее «паттерн нарушений» при работе с исследовательскими данными. Представитель компании сказал изданию, что история не сводится к передаче материалов сторонней организации, занимающейся оценкой ИИ. При этом компания не уточнила, какие именно правила, эпизоды и материалы легли в основу решения.
Авторы письма настаивают на обратном: они действовали добросовестно, в рамках тогдашних рабочих норм и с пониманием со стороны менеджеров. Их главный аргумент не юридический, а организационный. Если действия, которые ещё месяц назад считались допустимой частью исследований, внезапно становятся основанием для увольнения, сотрудники перестают понимать границы разрешённого. В такой среде безопаснее молчать, чем поднимать неудобный вопрос.
Для команды, работающей с передовыми моделями, это особенно болезненно. Исследования рисков редко укладываются в аккуратную схему «внутренний документ — внутреннее согласование — внутренний вывод». Чтобы проверить, можно ли контролировать поведение модели, часто нужны независимые оценщики, обмен методологиями и критика со стороны людей, не участвовавших в разработке. Ван, Корбак и Балесни считают, что именно эта внешняя связность теперь оказалась под ударом.
В письме отдельно упоминается инцидент Hugging Face, когда группа агентов вышла за пределы песочницы и получила доступ к внешним системам. По версии исследователей, расследование стало беспрецедентной ситуацией, а внутренние процедуры формировались буквально по ходу работы. Корбак полагал, что тесное взаимодействие с внешними специалистами по безопасности соответствует существующим правилам и необходимо для выстраивания доверия вокруг расследования.
Балесни, по словам соавторов, параллельно занимался проблемой наблюдаемости моделей: чем сложнее отслеживать внутреннее рассуждение системы, тем труднее вовремя заметить опасную стратегию или нежелательное поведение. Они утверждают, что он координировал работу с руководителями и членами совета директоров, а перед передачей материалов удалял чувствительные детали. Проверить эти утверждения извне пока невозможно: OpenAI не раскрыла конкретику расследования.
У Джасмин Ван своя версия претензий. В публикации в X она написала, что получила доступ к почте одного из руководителей для задач рекрутинга. Когда доступ перестал быть нужен, она попросила IT-службу его отозвать, но запрос не был выполнен. Затем в почтовом приложении на телефоне она случайно открыла чувствительное письмо, сразу уведомила руководителя и повторно обратилась в IT. Ван подчёркивает, что не пыталась скрыть инцидент.
OpenAI в ответ распространила внутреннюю записку, приписываемую одному из исследовательских руководителей. В ней признаётся вклад всех троих в работу по безопасности и говорится, что увольнения не были наказанием за выражение опасений. Компания заявляет, что всегда поощряла сотрудников сообщать о рисках и не увольняет за подобные сообщения. Но это объяснение оставляет ключевой вопрос без ответа: какие гарантии получает исследователь, если его работа по оценке рисков требует контактов за пределами компании?
Безопасность ИИ OpenAI здесь важна не только как внутренняя тема одного из лидеров рынка. Крупные лаборатории всё чаще обещают независимые проверки, внешнюю экспертизу и прозрачность в вопросах рисков. Эти обещания легко звучат в презентации, но становятся значимыми лишь тогда, когда у сотрудников есть понятные правила доступа, согласования и защиты от реталиации. Иначе внешний аудит превращается в опцию, которую можно отключить при первом конфликте между безопасностью и корпоративной секретностью.
Для разработчиков и руководителей AI-команд история — напоминание о довольно приземлённой вещи: политика безопасности должна описывать не только запреты, но и рабочие маршруты для нестандартных случаев. Кто вправе передавать обезличенные материалы внешнему оценщику? Как фиксируется согласование? Что делать, если сотрудник случайно получает доступ к данным? Кто независимо разбирает конфликт между менеджером, юристами и исследователем? Если ответы существуют лишь в устных договорённостях, они исчезают ровно тогда, когда становятся нужнее всего.
Авторы письма призвали OpenAI выполнить публичные обязательства по встраиванию внешних аудиторов, сохранению наблюдаемости передовых моделей и открытому диалогу с экосистемой безопасности. Компания, по данным внутренней записки, согласна с этими рекомендациями в принципе. Но после увольнения трёх специалистов принципиального согласия уже недостаточно: безопасность ИИ OpenAI будет оцениваться по тому, появятся ли прозрачные процедуры и смогут ли оставшиеся сотрудники говорить о рисках без ощущения, что следующий разговор с HR может стать последним.