GPT-4o Transcribe Diarize
GPT-4o Transcribe Diarize — модель OpenAI, которая расшифровывает запись и отмечает, какой участник произносит каждый фрагмент.
GPT-4o Transcribe Diarize — модель распознавания речи OpenAI с диаризацией: она связывает сегменты расшифровки с разными говорящими. О запуске модели в Audio API команда OpenAI объявила 14 ноября 2025 года. Эта функция особенно полезна для записей, где важно различать реплики участников, а не получать единый поток текста.
Как работает диаризация
Текст вместе с разметкой говорящих
В обычной расшифровке реплики участников могут идти одним текстовым блоком. Diarize добавляет к сегментам отметки говорящего, а также временные границы фрагментов. В документации OpenAI предусмотрен формат diarized_json; он возвращает текст и сегменты с данными о том, кто и в какой момент говорил. Модель предназначена именно для API транскрибации, а не для генерации речи.
Когда полезно разделение по участникам
Интервью, встречи и разговоры
Разделение реплик помогает готовить черновики протоколов совещаний, расшифровки интервью и записи звонков. Оно не подтверждает личность человека: метка говорящего — техническая группировка речевых фрагментов внутри записи. Для важных документов стоит проверить, правильно ли сопоставлены реплики, особенно если голоса похожи или участники часто перебивают друг друга.
Поддержка в API
Планируемое прекращение работы модели
В августе 2026 года OpenAI включила GPT-4o Transcribe Diarize в список моделей, выводимых из API 26 февраля 2027 года. Для новых систем компания указывает GPT Transcribe и GPT Live Transcribe. Если проект уже использует diarized_json, перед миграцией нужно проверить, какой формат сегментации и метки говорящих доступен у модели-замены.
Связанные модели
Для сравнения возможностей и поколений посмотрите также: GPT-4o Transcribe; GPT Transcribe; GPT Live Transcribe.
Сведения о разработчике и его моделях: OpenAI в Вики Futuretools.ru.
Официальный источник: материал разработчика.