GPT-4o Mini Audio
GPT-4o Mini Audio — компактная модель OpenAI для текстового и голосового ввода и ответа через Chat Completions API.
GPT-4o Mini Audio — уменьшенная версия аудиомодели GPT-4o, доступная через Chat Completions API. Первоначальный снимок `gpt-4o-mini-audio-preview-2024-12-17` появился 17 декабря 2024 года. Модель принимает аудио или текст и может формировать звуковой либо текстовый ответ.
Аудиовозможности компактной модели
Голосовой ввод и ответ через API чата
OpenAI описывает эту версию как способ создавать аудиофункции при меньшей стоимости, чем у старшей модели GPT-4o Audio. Приложение могло передать голосовой запрос и получить сгенерированную речь или текст. Модель относится к обработке аудио в запросе и не эквивалентна постоянному двустороннему соединению для живого разговора.
Не путать с GPT-4o Mini Realtime
Одинаковая основа — разные интерфейсы
Для потока речи в Realtime API существовала отдельная GPT-4o Mini Realtime. В этой статье рассматривается именно аудиомодель Chat Completions. Такое разделение важно при оценке доступных режимов, структуры запроса и интеграции с приложением.
Снимки и прекращение поддержки
API-идентификатор больше не доступен
OpenAI выпускала датированный снимок этой модели в декабре 2024 года; в июне 2025 года появилось обновление основного аудиосемейства GPT-4o. В сентябре 2025 года компания объявила об отключении GPT-4o Mini Audio Preview с 7 мая 2026 года. Рекомендуемая замена — GPT-Audio Mini.
Соседние модели
Синтез речи и аудиорассуждение
Если задача — только озвучить готовый текст, у OpenAI есть специализированная модель GPT-4o Mini TTS. Если нужно анализировать запись и вести диалог, уместнее сравнить GPT-Audio и GPT-Realtime Mini.
Сведения о разработчике и его моделях: OpenAI в Вики Futuretools.ru.
Официальный источник: материал разработчика.