OpenAI запускает GPT-Live для живого голосового общения в ChatGPT
OpenAI представила GPT-Live — новое поколение голосовых моделей для ChatGPT. Модель делает диалог с ИИ более похожим на живой разговор: она звучит естественнее, лучше удерживает контекст беседы и рассчитана на более выразительное общение.
Ключевая особенность GPT-Live — полносимплексная архитектура, то есть модель может одновременно слушать пользователя и отвечать. Это должно сделать обмен репликами менее механическим и помочь в сценариях вроде перевода в реальном времени.
Для сложных запросов GPT-Live сможет передавать задачу более мощной модели за кулисами: например, если нужен поиск в интернете, глубокий анализ или многошаговая работа. Развёртывание уже началось в ChatGPT на iOS, Android и в веб-версии, а API-доступ обещан позже.
Почему это важно
- —Голосовой режим ChatGPT становится ближе к естественной беседе, а не к обмену отдельными командами.
- —Полносимплексный подход может улучшить перевод в реальном времени и диалоги, где важны паузы, перебивания и контекст.
- —Интеграция с более мощной моделью за кулисами расширяет голосовой интерфейс до сложных аналитических задач.
Ключевые факты
- GPT-Live разворачивается в ChatGPT с сегодняшнего дня и станет доступен всем пользователям в ближайшие дни.
- Модель выйдет на iOS, Android и в веб-версии ChatGPT.
- GPT-Live может одновременно слушать и говорить благодаря полносимплексной архитектуре.
- Для сложных запросов модель сможет делегировать работу более мощной frontier-модели и вернуть результат в разговор.
- API-доступ к новым голосовым моделям появится позже.
Полный текст — в первоисточнике. Здесь — краткое изложение и ключевые факты.