Исследователи продемонстрировали новую уязвимость в системах ИИ: атака MemGhost позволяет изменять воспоминания ИИ-ассистента всего через одно электронное письмо. Это создаёт опасность для пользователей, так как они могут не заметить, как их ассистенты получают неверную информацию.
Что такое MemGhost?
MemGhost — это метод, который использует одно отправленное письмо для внедрения ложных данных в память ИИ-агента. Сначала ИИ принимает письмо как обычное, но затем начинает запоминать и использовать искаженную информацию при следующих взаимодействиях. Например, согласно уязвимости, ассистент может начать сообщать о повышенном лимите переводов через Zelle до $10,000, в то время как на самом деле этот лимит не изменен.
Как это работает
Атакующий не нуждается в пароле жертвы для проведения операции; достаточно всего лишь отправить письмо на адрес, который проверяет ИИ-ассистент. Если письмо содержит специальный текст, ассистент может случайно внедрить ложное утверждение в свою постоянную память. Исследователи подчеркивают, что этот процесс происходит незаметно для пользователя.
В тестах атака успешно прошла в 87,5% случаев с использованием OpenClaw на базе GPT-5.4 и 71,4% с агентом Claude Code SDK. Это позволяет предположить, что уязвимости IИ-ассистентов могут стать серьезной угрозой.
Выводы для пользователей
Для пользователей это означает, что доверие к ИИ-ассистентам может быть подорвано. Так как эти алгоритмы становятся более внедренными в повседневную жизнь, важно быть внимательными к тому, какую информацию они предоставляют. Разработчикам стоит обратить внимание на безопасность и предупреждения о таких атаках.
Следующий шаг — разработка технологий и методов защиты от подобных атак. Важно создать механизмы, которые помогут предотвратить подмену информации и защитить личные данные пользователей.