OpenAI обновил голосовой режим ChatGPT, выпустив модель GPT-Live-1, которая меньше перебивает и лучше реагирует на паузы в разговоре. Это важное улучшение для пользователей, желающих более естественного взаимодействия с ИИ.
Особенности обновлённого голосового режима
Модель GPT-Live-1 позволяет ChatGPT одновременно говорить и слушать, тем самым обеспечивая более плавный диалог. Как уточнил руководитель исследований OpenAI Кундан Кумар, новая модель считается «умнейшей голосовой моделью компании». Она автоматически передаёт запросы в текстовые модели, такие как GPT-5.5, для более быстрого поиска информации и диалогов.
Кроме того, ChatGPT теперь может обращать внимание на мир и предлагать визуальные данные, например, прогноз погоды или текущие спортивные результаты, что значительно увеличивает информативность общения.
Что это значит для пользователей
Предыдущее поколение голосового режима имело недостатки, включая возможность перебивать собеседника и недостаточно естественный поток разговора. Теперь ChatGPT может переводить речь в реальном времени, не дожидаясь, пока пользователь закончит говорить. Также добавлена возможность остановить голосовой режим по желанию, что ранее было невозможно.
OpenAI заявляет о введении новых встроенных мер безопасности, которые уменьшают вероятность получения нежелательных или вредных ответов в «высокий риск» ситуациях, таких как разговоры о самоубийстве, обеспечивая поддержку, основанную на экспертных рекомендациях.
Практическое значение для рынка
Для пользователей ChatGPT в России и СНГ нововведение открывает новые возможности общения с ИИ. Более естественный диалог может поднять уровень продуктивности в повседневных задачах, таких как управление расписанием, получение информации и решение рабочих вопросов. Это также создаёт новый стандарт для применения голосовых технологий в других продуктах.
GPT-Live-1 начнёт работать на iOS, Android и в веб-версии. Он будет доступен для подписчиков Plus и Pro, а более компактная версия станет стандартом для бесплатных пользователей.