Восемь моделей на пяти датасетах показали: сжатие пользовательских промптов не экономит токены, а часто повышает итоговую стоимость работы ИИ.