Исследование Microsoft выяснило, что современные языковые модели AI искажают до 25% содержания документов при многократной работе с ними. Это ставит под сомнение надежность таких систем для выполнения знаний и редактирования в деловой среде — и вызывает вопросы о том, чего стоит ожидать от автоматизации в будущем.
Текущий статус AI в работах с документами
В эпоху, когда языковые модели становятся все более сложными и компетентными, пользователи начинают доверять AI выполнение задач по обработке документов. Однако, новый подход к автоматизации, получивший название «делегированная работа», требует от пользователей значительной доверия к модели. Каждый выбирает, насколько готов полагаться на AI для анализа и редактирования контента.
Открытия исследования DELEGATE-52
Исследование основывается на разработанном Microsoft методе под названием DELEGATE-52, который позволяет симулировать многоэтапные рабочие процессы в 52 профессиональных областях. Используя 310 реальных рабочих сред с текстами документов от 2000 до 5000 токенов, исследователи отметили, что убережное поручение работы AI может привести к значительным искажениям содержимого.
В процессе эксперимента выяснили, что даже при использовании сложных задания, модели не всегда способны сохранить первоначальное содержание текста. Установка таких «агентских инструментов» лишь ухудшает ситуацию, из-за чего пользователи могут недосмотреть за качеством изменений и допустить ошибки.
Чему следует научиться пользователям
Для российского бизнеса понимание ограничений технологий AI особенно актуально. Надежда на автоматизацию не всегда оправдана; 25% ошибок в результате работы моделей могут существенно повлиять на финансовую отчетность или управление проектами, особенно в таких сферах, как бухгалтерский учёт и программная инженерия.
Это свидетельствует о необходимости наличия контрольных мер, таких как ручная проверка или внедрение дополнительного анализа результатов. Пользователи должны осознать: чем больше они полагаются на AI, тем более критично становится их взаимодействие с моделью.
В будущем, такие технологии будут развиваться, однако важно помнить, что реальный контроль и понимание работы AI остаются на плечах человека.