GPT-Audio Mini
GPT-Audio Mini — более экономичная модель OpenAI для аудиоввода и генерации речи в Chat Completions API.
OpenAI представила GPT-Audio Mini 6 октября 2025 года как более экономичный вариант GPT-Audio. Модель принимает звук и текст, а затем возвращает текстовый или голосовой ответ через Chat Completions API. Позднее компания обновила рабочий псевдоним до снимка `gpt-audio-mini-2025-12-15`, не создавая отдельное семейство модели.
Для каких сценариев подходит Mini
Аудиофункции при ограничении стоимости
Вариант Mini предназначен для приложений, которым нужны аудиоввод и ответ голосом, но не требуется использовать более дорогую базовую модель. Его можно применять в диалоговых помощниках, обработке голосовых обращений и интерфейсах с короткими речевыми запросами. Фактическая задержка и качество зависят от настройки API, сети и самого приложения.
Чем отличается от GPT-Realtime Mini
Chat Completions против потокового обмена
GPT-Audio Mini формирует аудиоответ в обычном API-запросе Chat Completions. GPT-Realtime Mini предназначена для двустороннего разговора в Realtime API, где обмен аудио идёт в рамках живой сессии. Выбор зависит от того, требуется ли приложению единичная обработка записи или непрерывный голосовой диалог.
Снимки и дальнейшая замена
Версия 15 декабря 2025 года
Обновлённый снимок принёс заявленные OpenAI улучшения надёжности, качества и точности голоса. API-псевдоним `gpt-audio-mini` указывает на актуальный снимок, а имя с датой позволяет зафиксировать конкретную версию. OpenAI объявила, что семейство GPT-Audio Mini будет выведено из API 20 января 2027 года; для миграции рекомендован GPT-Audio-1.5.
Связь с другими моделями OpenAI
Аудиомодели и транскрибация — разные задачи
Если приложению нужно получить текстовую расшифровку записи, предназначены отдельные модели GPT-Transcribe и GPT-Live-Transcribe. GPT-Audio Mini, напротив, обрабатывает аудио как часть диалогового ответа.
Сведения о разработчике и его моделях: OpenAI в Вики Futuretools.ru.
Официальный источник: материал разработчика.