OpenAI в ближайшие недели начнёт добавлять водяные знаки ChatGPT и Codex в тексты, созданные пользователями из Евросоюза. Метка будет невидимой для читателя, но пригодной для машинной проверки: это ответ на вступившие в силу 2 августа требования прозрачности европейского AI Act. Для русскоязычных команд, работающих с клиентами или продуктами в ЕС, это означает, что происхождение текста от OpenAI станет отдельным параметром комплаенса, а не только вопросом редакционной политики.
О планах компании сообщает TechCrunch. Маркировка затронет подходящих пользователей ChatGPT и Codex на всех тарифах, но на старте будет применяться только в ЕС. Разработчики по всему миру уже могут включить её через API для отдельных моделей, однако по умолчанию опция выключена. Делать такую маркировку глобальной настройкой OpenAI пока не собирается.
Речь не о видимой подписи вроде «создано ИИ» и не о метаданных файла, которые исчезают после копирования текста в мессенджер или CMS. Метод работает иначе: модель слегка меняет выбор слов при генерации, формируя статистический паттерн. Человек его не замечает, а специальный детектор при наличии ключа может распознать. Поэтому метка сохраняется при обычном копировании и вставке текста — например, из ChatGPT в Google Docs, корпоративный портал или письмо клиенту.
OpenAI называет подход textGrain и одновременно с объявлением опубликовала технический отчёт, подготовленный вместе с исследователями Пенсильванского университета и Йеля. В упрощённом виде система использует секретный ключ, который влияет на ранжирование допустимых вариантов следующего слова. Один такой выбор ничего не доказывает. Но сотни небольших отклонений в длинном тексте дают детектору достаточно сигнала, чтобы оценить вероятность генерации моделью.
Для бизнеса важна и граница этой технологии. Водяной знак не должен деанонимизировать пользователя: OpenAI заявляет, что он не содержит идентификатор конкретного человека. Компания также говорит, что включение маркировки не привело к заметному ухудшению качества ответов. Это снижает риск для команд, использующих ChatGPT или Codex как рабочий инструмент, но не снимает вопросов о том, как результаты детектора будут трактовать работодатели, редакции, вузы, подрядчики и регуляторы.
Главное ограничение OpenAI формулирует без иллюзий: редактирование способно ослабить сигнал. В одном из тестов замена синонимами 10% слов снизила вероятность обнаружения примерно с 92% до 66%. Сложнее проверять короткие фрагменты, решения математических задач и переведённые тексты. Иными словами, система лучше подходит для анализа достаточно длинного, относительно нетронутого материала, чем для вынесения вердикта по одному абзацу в чате или переработанной статье.
Отсутствие метки тоже не будет доказательством человеческого авторства. Текст мог оказаться слишком коротким, пройти серьёзную редактуру, быть создан другой моделью или нести следы ИИ лишь в отдельных фрагментах. Это особенно существенно для продуктовых и HR-команд: автоматическая проверка может быть дополнительным сигналом в процессе, но не надёжным детектором «честности» кандидата, автора или подрядчика.
Европейский AI Act требует, чтобы поставщики ИИ-систем обеспечивали машиночитаемую идентификацию синтетического контента. Однако сам закон не превращает одну конкретную технологию в отраслевой стандарт. OpenAI, Anthropic, Google, Meta и Microsoft входят в число компаний, обязавшихся следовать европейскому кодексу практики по контенту, созданному ИИ. Anthropic двумя месяцами ранее сообщила о планах маркировать тексты Claude по всему миру. Это решение вызвало недовольство части пользователей: они указывали, что задают контекст, принимают решения и редактируют результат, а модель остаётся инструментом.
Этот спор не сводится к технической детали. Для разработчика генеративный ИИ может быть помощником при написании документации или кода; для редактора — источником черновика; для компании — частью производственного процесса. Метка сообщает лишь то, что система OpenAI сгенерировала или обработала часть текста. Она не отвечает, сколько в результате человеческой экспертизы, творчества и ответственности. Поэтому водяные знаки ChatGPT скорее помогут выстраивать процедуры раскрытия использования ИИ, чем автоматически отделят «машинный» контент от «человеческого».
У OpenAI уже была технология текстовой маркировки, но компания ранее не выпускала её широко, опасаясь ухода пользователей к конкурентам без подобных ограничений. Теперь регуляторный стимул в ЕС оказался сильнее этого риска. Следующий практический вопрос — смогут ли независимые детекторы работать достаточно точно и появится ли совместимый стандарт между разными поставщиками моделей. Пока textGrain выглядит не печатью подлинности, а полезным, но легко ослабляемым сигналом. Подробнее о техническом подходе можно прочитать в материале .