GPT-Live 1

Речевая модель OpenAI для непрерывных голосовых диалогов и приложений с малой задержкой.

GPT-Live 1 — модель OpenAI для двустороннего голосового общения в реальном времени. Она стала общедоступна в API 10 сентября 2026 года. Разработчик может строить диалог, который продолжается, пока серверная модель или агент параллельно выполняет рассуждение и вызывает инструменты.

Голосовой диалог без длинных пауз

Вместо раздельных запросов на запись, распознавание, ответ и озвучивание Live-сессия рассчитана на непрерывный обмен речью. Это полезно для голосовых помощников, поддержки и других приложений, где задержка заметна человеку. Модель обрабатывает голосовой поток; подключение к поиску и внешним системам зависит от приложения.

Состав расходов

В журнале OpenAI указана тарификация голосовой сессии по времени, отдельно от использования подключённой модели и инструментов. Поэтому полная стоимость зависит не только от длительности речи, но и от задач, которые агент выполняет в фоне.

Доступ разработчикам

GPT-Live 1 предоставляется через интерфейс OpenAI API для работы с живыми сессиями. Она предназначена для разработчиков, которые создают собственный голосовой интерфейс, а не отдельное приложение для обычного пользователя.

Распознавание речи

Для преобразования аудиозаписей и речи в текст OpenAI выпустила отдельные модели GPT Transcribe и GPT Live Transcribe.

Читайте также: OpenAI в разделе вики.