120 896 слов с февраля 2026 года надиктовал автор ZDNet Дэвид Гевирц, прежде чем вынести вердикт по сервисам AI-диктовки. Как пишет ZDNet, для разработчиков, продактов и всех, кто живет между IDE, мессенджерами и почтой, голосовая диктовка уже выглядит не как демонстрация возможностей нейросетей, а как вполне рабочий способ ускорить рутину и чуть меньше мучить кисти.
В материале от 5 августа 2026 года Гевирц разбирает три основных инструмента, но ключевые выводы у него крутятся вокруг двух имен. По итогам тестов лучшим по скорости исправлений, пользовательскому словарю и общей надежности оказался Wispr Flow. Бесплатный FluidVoice, который работает локально, почти не отстал от платного лидера. Это важная развилка для рынка: речь уже не о том, умеет ли сервис распознавать английские слова без постоянных ляпов, а о том, насколько быстро он исправляет оговорки, понимает жаргон и не ломает рабочий темп.
Самый показательный факт в тексте даже не список победителей, а статистика использования. С февраля автор провел 2314 микросессий записи, в среднем по 24 слова за подход. То есть диктовка нужна ему не для торжественного надиктовывания романа в кресле, а для коротких боевых задач: ответить в чате, добросить мысль в письмо, быстро сформулировать промпт, зафиксировать заметку. Это хорошо бьется с реальностью любой продуктовой или инженерной команды: большая часть дня уходит не на длинные тексты, а на мелкие, но бесконечные куски коммуникации.
На этом фоне особенно интересно, что Гевирц считает главной метрикой не сырую точность распознавания, а исправления на лету. Если сервис понял фразу почти правильно, но не умеет быстро подхватить самоисправление пользователя, он проигрывает даже более скромному конкуренту. Второй критичный критерий это настраиваемый словарь, чтобы продукт знал, как писать брендовые названия, технические термины и внутренние сокращения. Для IT-аудитории это не косметика: если инструмент стабильно коверкает названия библиотек, тикетов, продуктов или команд, пользоваться им будут ровно до первого созвона после обеда.
При этом клавиатуру никто не отправляет на пенсию. Автор прямо пишет, что почти не диктует статьи целиком, хотя именно этот текст частично надиктован как демонстрация. Причина простая: голосовой ввод хорош для сплошного текста, но все еще плохо дружит с форматированием, таблицами, списками, цитатами и ювелирной правкой формулировок. Иначе говоря, для редакторской или архитектурной работы, где важен не только смысл, но и форма, руки пока выигрывают у голоса. Голосовая диктовка здесь не замена письму, а скорее турборежим для черновиков, переписки и быстрых инструкций.
Зато в других сценариях выигрыш уже вполне приземленный. Гевирц использует диктовку при работе с Claude Code и OpenAI Codex, в Slack и Google Chat, в ответах на письма, в заметках и поисковых запросах. По его оценке, он диктует в среднем со скоростью 118 слов в минуту, тогда как печатает на уровне 70-80 слов. Разница выглядит особенно убедительно там, где нужно быстро объяснить баг, накидать логику фичи или сформулировать задачу агенту. Для вайб-кодинга и живой инженерной коммуникации это, по сути, превращает голос в еще один интерфейс к рабочему стеку.
Есть и важная оговорка, которую бизнесу лучше не пропускать. Один из главных вопросов в обзоре это приватность: отправлять ли голос и текст в облако или держать обработку локально на устройстве. Победа Wispr Flow показывает, что облачные продукты пока сильнее в полировке результата и надежности. Почти равный результат FluidVoice показывает другое: локальные инструменты уже достаточно хороши, чтобы их начали рассматривать не только параноики, но и обычные команды с чувствительной внутренней перепиской. Правда, тест касался английского языка, так что переносить его выводы на русский без дополнительных проверок было бы слишком смело.
Пожалуй, самый неприятный вывод из текста в том, что рынок еще не закрыл базовую потребность: нормальное редактирование уже вставленного текста голосом. По словам автора, эту задачу более или менее решают только системные инструменты вроде Mac Voice Control или Windows Voice Access, но они нередко конфликтуют со сторонними сервисами диктовки. Получается типичная история зрелого, но не доделанного рынка: качество распознавания уже перестало быть главным барьером, а узкое место сместилось в UX и интеграцию с реальными приложениями.
Отсюда и главный вопрос на ближайший год: кто первым соберет голосовой ввод в действительно бесшовный слой поверх повседневной работы, где есть и локальная обработка, и адекватные правки на лету, и понимание профессионального словаря без ручного дрессирования. Если этот пазл сложится, голосовая диктовка окончательно выйдет из ниши ассистивных функций и станет таким же обычным инструментом для IT-специалиста, как почта, терминал или редактор кода.