OpenAI 23 июля выкатила в десктопный клиент новый голосовой режим ChatGPT: теперь на Mac и Windows можно не просто разговаривать с ботом, а голосом запускать, проверять и перенаправлять рабочие задачи в Chat, Work и Codex. Для русскоязычной IT-аудитории это важный сдвиг не в сторону «ещё одного голосового помощника», а в сторону интерфейса, где речь становится способом управлять агентной работой, файлами и даже действиями на компьютере.
Обновление, как сообщает 9to5Mac, построено на GPT-Live — это новая голосовая система OpenAI, которая в июле уже появилась на мобильных устройствах. В десктопной версии её упаковали в более прикладной сценарий: пользователь может открыть новый чат или задачу в голосовом режиме, а затем попросить ChatGPT начать работу, проверить прогресс или скорректировать действия в других тредах. Иначе говоря, голос здесь не для small talk, а для оркестровки нескольких параллельных процессов внутри одного рабочего пространства.
Список интеграций выглядит показательно. Новый голосовой режим ChatGPT работает вместе с Computer Use, то есть функцией управления действиями на компьютере, поддерживает локальные файлы и плагины ChatGPT. Для Mac есть отдельный бонус: функция Appshots позволяет модели учитывать активное окно, которое сейчас в фокусе. На практике это означает, что ассистент получает дополнительный контекст без вечного «подожди, я объясню, что у меня открыто». Для разработчиков, аналитиков и продактов это, пожалуй, даже важнее самого факта появления голоса: модель начинает ориентироваться не только на текст диалога, но и на текущую рабочую сцену.
OpenAI отдельно уточнила, что функция доступна не только корпоративным клиентам. Голос поддерживается на десктопе в планах Plus, Pro, Business, Edu и Enterprise. Это заметно расширяет круг пользователей, которые смогут проверить сценарий «говорю — агент делает» без отдельного enterprise-проекта и без кастомной интеграции. Ещё одна деталь: режим работает и вместе с функцией Remote на iOS. Логика понятна: OpenAI собирает единый слой управления задачами, который не привязан жёстко к одному устройству. Командовать можно с телефона, а исполняться это будет в десктопной среде, где лежат файлы, проекты и инструменты.
На уровне продукта ход тоже читается довольно ясно. Раньше голос в ChatGPT чаще воспринимался как демонстрация разговорного ИИ: удобно, эффектно, но не всегда связано с реальной работой. Теперь OpenAI продаёт другую идею: голос как командный интерфейс для агентной системы. В опубликованном компанией сообщении это сформулировано почти без маскировки: пользователь может управлять компьютером и направлять сразу нескольких агентов в ChatGPT Work или Codex с помощью голоса. Если убрать маркетинговую полировку, выходит вполне прагматичная картина. OpenAI хочет, чтобы взаимодействие с ИИ всё меньше напоминало переписку в мессенджере и всё больше — диспетчерскую, где текст, речь, файлы и действия склеены в один контур.
Здесь важен и контекст последних месяцев. Десктопное приложение ChatGPT постепенно перестаёт быть просто «окном к чату» и всё заметнее превращается в оболочку для работы с агентами. До этого OpenAI уже двигалась в сторону ChatGPT Work и интеграции с Codex, а теперь добавляет голос как ещё один слой управления. Для части пользователей это может выглядеть как странная эволюция: отдельный Codex-флер, перегруженный интерфейс, спорное ощущение «нативности» на Mac никуда не делись. Но с точки зрения продуктовой стратегии всё последовательно: если модель умеет не только отвечать, но и действовать, то логично дать ей самый быстрый канал инструкций. Печатать «проверь статус, открой файл, сравни ветки, вернись в предыдущий тред» менее естественно, чем просто проговорить это вслух.
Параллельно с голосом OpenAI обновила механику локальных проектов в десктопном приложении. Теперь один проект может включать несколько связанных папок. В меню Edit project можно добавить дополнительные директории и выбрать основную папку. Именно она будет использоваться для новых чатов, git-операций и автоматического обнаружения AGENTS.md, skills и config.toml. Второстепенные папки останутся доступными для поиска, чтения и редактирования файлов. Для тех, кто работает не в одном аккуратном репозитории, а в реальных боевых условиях с монорепами, соседними сервисами, документацией и вспомогательными скриптами, это обновление может оказаться не менее полезным, чем сам голос. Оно убирает часть трения, которое неизбежно возникает, когда ИИ-инструмент пытается притвориться, будто все живут в идеально изолированных каталогах.
Что это значит для рынка и для команд? Во-первых, голосовой интерфейс окончательно перестаёт быть игрушкой для демо и начинает конкурировать за место в повседневной работе. Во-вторых, OpenAI всё плотнее связывает разговорный слой с инструментальным: не «спроси модель», а «поручи, уточни, скорректируй». Для разработчиков это может ускорить рутинные операции, когда руки заняты кодом, ревью или переключением между окнами. Для менеджеров и фаундеров — снизить порог входа в агентные сценарии: не нужно помнить команды или строить длинные промпты, если задачу можно надиктовать. Для HR и внутренних платформенных команд это ещё и сигнал, что корпоративное использование ИИ будет всё чаще завязано не на отдельные чаты, а на рабочие процессы с доступом к файлам, проектам и действиям на машине. А значит, вопросы безопасности, разграничения прав и аудита никуда не денутся, просто теперь к ним добавится слой голосового управления.
Главный вопрос теперь не в том, удобно ли разговаривать с ИИ. Этот этап рынок уже почти проскочил. Вопрос в другом: готовы ли пользователи принять модель, которая одновременно слушает, говорит, читает локальные файлы, видит активное окно и раздаёт команды агентам. Если такой режим действительно станет быстрее клавиатуры хотя бы в части рабочих сценариев, голосовой режим ChatGPT может оказаться не косметическим апдейтом, а ещё одним шагом к интерфейсу, где чат перестаёт быть центром, а становится лишь одной из форм управления. Подробности обновления собраны в материале .
