GPT Transcribe
Модель OpenAI для расшифровки аудиофайлов и подготовки итогового текста после голосового разговора.
GPT Transcribe — модель OpenAI для преобразования аудио в текст, выпущенная 28 июля 2026 года. Она предназначена для расшифровки загруженных файлов и получения итоговой стенограммы завершённого голосового разговора.
Расшифровка записей
Модель можно использовать для переноса интервью, встреч, телефонных разговоров и других записей в текст. В API доступны подсказки по ожидаемому языку и специальным словам, которые помогают распознавать имена или термины. Результат зависит от качества звука, количества говорящих и фонового шума.
Проверка стенограммы
Автоматическая расшифровка может ошибаться в числах, именах и фрагментах с плохой слышимостью. Перед использованием стенограммы как протокола встречи или первичного документа стоит проверить важные фрагменты по записи.
Чем отличается от Live Transcribe
GPT Transcribe предназначена для завершённого аудиофайла или итогового текста разговора. Для потокового распознавания с малой задержкой создана отдельная GPT Live Transcribe. Обе модели OpenAI объявила 28 июля 2026 года.
Читайте также: OpenAI в разделе вики.