Голосовой режим Claude перестал быть демонстрацией на минималках. После июльского обновления 2026 года он работает не только через быстрый, но ограниченный Haiku, а и через Sonnet и Opus, может обращаться к подключенным сервисам и поддерживает 11 языков. Для русскоязычных команд, которые работают на английском или других поддерживаемых языках, это важный сдвиг: голосовой интерфейс у Anthropic из «любопытной опции» превращается в инструмент, который уже можно примерять к рабочим сценариям.
О деталях сообщает Engadget: Anthropic обновила voice mode, который компания предлагает с 2025 года. Раньше голосовой режим был завязан только на Haiku, самой легкой модели Claude, чтобы держать низкую задержку. Теперь пользователю дают выбор между тремя моделями. Haiku оставили для быстрых ответов, Sonnet позиционируется как основной вариант на каждый день, а Opus предназначен для более сложных задач, но доступен только на платных тарифах. Из практических последствий это, пожалуй, главное: голосом теперь можно не только спросить «что у меня по календарю», но и обсуждать более сложные рабочие вопросы без автоматического отката на слабую модель.
Сам запуск сделан без лишней драмы. Голосовой режим доступен в мобильных приложениях Claude для Android и iOS, в десктопном приложении и в веб-версии. При этом сама Anthropic отдельно оговаривает, что лучше всего функция работает со смартфона. На мобильном нужно открыть приложение, нажать не на значок микрофона, а на черную иконку с волной в правом нижнем углу, при необходимости выдать доступ к микрофону и говорить. Режим остается активным, пока пользователь не нажмет «Стоп». Деталь вроде бы бытовая, но для продуктовых команд она показательна: Anthropic пока явно мыслит этот сценарий как мобильный, почти «рацию» для общения с ИИ, а не как полноценную замену традиционному чату на рабочем столе.
Есть и техническое ограничение, которое важно понимать до того, как кто-то в компании решит строить на этом демо для руководства. Голосовой режим Claude работает по turn-based-схеме: сначала слушает, потом отвечает. То есть это не одновременный разговор, а скорее обмен репликами по очереди. На фоне ChatGPT это выглядит чуть менее естественно, потому что OpenAI перевела свой голосовой режим на duplex-архитектуру, где модель может параллельно обрабатывать речь и формировать ответ. В реальном использовании разница быстро становится заметной: Claude может принять короткую паузу за конец вопроса. Поэтому Anthropic советует не складывать длинные составные запросы в одну фразу, а задавать их по частям. Для обычного пользователя это мелкая фрикция. Для разработчиков и продуктовых менеджеров это уже характеристика интерфейса: если сценарий требует живого перебивания, уточнений на лету и плотного диалога, у Claude пока есть ограничения на уровне самой модели взаимодействия.
Зато в другом месте Anthropic явно бьет в корпоративное использование. Как и в текстовом чате, голосовой режим умеет подтягивать данные из подключенных приложений и сервисов, включая Gmail, Google Calendar и Slack. Пример из статьи предельно приземленный: можно попросить Claude голосом кратко пересказать недавние письма. Если сервис подключается впервые, придется выдать разрешение на доступ. Эта часть выглядит куда интереснее самих «голосов» и скоростей речи. Рынок давно движется не к абстрактному «поговорить с ИИ», а к модели, где ассистент становится голосовым слоем над рабочим стеком. Если Claude по голосовой команде сводит почту, проверяет календарь и достает контекст из Slack, это уже не игрушка для вау-эффекта, а заготовка под ежедневный операционный интерфейс для менеджеров, основателей и команд лидов.
С настройками у Anthropic тоже все довольно прагматично. По состоянию на июль 2026 года voice mode поддерживает 11 языков: английский, французский, немецкий, хинди, индонезийский, итальянский, японский, корейский, бразильский португальский, испанский для Латинской Америки и испанский для Испании. Язык влияет на выбор голоса: например, в английском доступно пять вариантов, а в японском только два. Также можно менять скорость речи между медленной, нормальной и быстрой и выбирать режим записи: hands free или push to talk. Но есть ограничение, которое для многоязычных команд будет неприятным: Claude не умеет корректно отслеживать переключение языка посреди одной фразы. Если пользователь собирается перейти на другой язык, Anthropic рекомендует либо проговорить это явно, либо заранее сменить язык в настройках.
Отдельно стоит вопрос денег, потому что именно на нем чаще всего ломаются «доступные для всех» AI-функции. Здесь схема сравнительно мягкая: платить за доступ к голосу как таковому не нужно. Бесплатные аккаунты могут использовать голосовой режим Claude, но их запросы идут через Haiku, а Opus остается платной опцией. При этом голосовые сессии засчитываются в лимиты использования, а бесплатным пользователям разрешено только одно подключение к внешнему сервису. То есть для личных сценариев вроде «разбери мою почту и напомни про встречу» этого может хватить, а вот для полноценной интеграции в рабочую рутину ограничения почувствуются быстро. С точки зрения бизнеса это типичная воронка: дать попробовать достаточно, чтобы сформировать привычку, а затем упереть более сложные сценарии в подписку и лимиты.
Для русскоязычного IT-рынка вывод довольно прямой. Голосовые ассистенты окончательно уходят от статуса демонстрации, где модель просто красиво озвучивает ответ. Теперь конкуренция идет за три вещи: качество базовой модели, доступ к рабочему контексту и естественность самого разговора. У Claude уже сильная связка с сервисами и заметно более серьезная модельная база, чем была у него в голосовом режиме раньше. Но пока остается вопрос, что окажется важнее в повседневной работе: глубина ответов через Sonnet и Opus или более живой разговорный темп у систем, которые уже перешли на duplex-архитектуру.