GPT-4o Mini Audio

GPT-4o Mini Audio — компактная модель OpenAI для текстового и голосового ввода и ответа через Chat Completions API.

GPT-4o Mini Audio — уменьшенная версия аудиомодели GPT-4o, доступная через Chat Completions API. Первоначальный снимок `gpt-4o-mini-audio-preview-2024-12-17` появился 17 декабря 2024 года. Модель принимает аудио или текст и может формировать звуковой либо текстовый ответ.

Аудиовозможности компактной модели

Голосовой ввод и ответ через API чата

OpenAI описывает эту версию как способ создавать аудиофункции при меньшей стоимости, чем у старшей модели GPT-4o Audio. Приложение могло передать голосовой запрос и получить сгенерированную речь или текст. Модель относится к обработке аудио в запросе и не эквивалентна постоянному двустороннему соединению для живого разговора.

Не путать с GPT-4o Mini Realtime

Одинаковая основа — разные интерфейсы

Для потока речи в Realtime API существовала отдельная GPT-4o Mini Realtime. В этой статье рассматривается именно аудиомодель Chat Completions. Такое разделение важно при оценке доступных режимов, структуры запроса и интеграции с приложением.

Снимки и прекращение поддержки

API-идентификатор больше не доступен

OpenAI выпускала датированный снимок этой модели в декабре 2024 года; в июне 2025 года появилось обновление основного аудиосемейства GPT-4o. В сентябре 2025 года компания объявила об отключении GPT-4o Mini Audio Preview с 7 мая 2026 года. Рекомендуемая замена — GPT-Audio Mini.

Соседние модели

Синтез речи и аудиорассуждение

Если задача — только озвучить готовый текст, у OpenAI есть специализированная модель GPT-4o Mini TTS. Если нужно анализировать запись и вести диалог, уместнее сравнить GPT-Audio и GPT-Realtime Mini.

Сведения о разработчике и его моделях: OpenAI в Вики Futuretools.ru.

Официальный источник: материал разработчика.