GPT-Live 1
Речевая модель OpenAI для непрерывных голосовых диалогов и приложений с малой задержкой.
GPT-Live 1 — модель OpenAI для двустороннего голосового общения в реальном времени. Она стала общедоступна в API 10 сентября 2026 года. Разработчик может строить диалог, который продолжается, пока серверная модель или агент параллельно выполняет рассуждение и вызывает инструменты.
Голосовой диалог без длинных пауз
Вместо раздельных запросов на запись, распознавание, ответ и озвучивание Live-сессия рассчитана на непрерывный обмен речью. Это полезно для голосовых помощников, поддержки и других приложений, где задержка заметна человеку. Модель обрабатывает голосовой поток; подключение к поиску и внешним системам зависит от приложения.
Состав расходов
В журнале OpenAI указана тарификация голосовой сессии по времени, отдельно от использования подключённой модели и инструментов. Поэтому полная стоимость зависит не только от длительности речи, но и от задач, которые агент выполняет в фоне.
Доступ разработчикам
GPT-Live 1 предоставляется через интерфейс OpenAI API для работы с живыми сессиями. Она предназначена для разработчиков, которые создают собственный голосовой интерфейс, а не отдельное приложение для обычного пользователя.
Распознавание речи
Для преобразования аудиозаписей и речи в текст OpenAI выпустила отдельные модели GPT Transcribe и GPT Live Transcribe.
Читайте также: OpenAI в разделе вики.