GPT-4o Transcribe Diarize

GPT-4o Transcribe Diarize — модель OpenAI, которая расшифровывает запись и отмечает, какой участник произносит каждый фрагмент.

GPT-4o Transcribe Diarize — модель распознавания речи OpenAI с диаризацией: она связывает сегменты расшифровки с разными говорящими. О запуске модели в Audio API команда OpenAI объявила 14 ноября 2025 года. Эта функция особенно полезна для записей, где важно различать реплики участников, а не получать единый поток текста.

Как работает диаризация

Текст вместе с разметкой говорящих

В обычной расшифровке реплики участников могут идти одним текстовым блоком. Diarize добавляет к сегментам отметки говорящего, а также временные границы фрагментов. В документации OpenAI предусмотрен формат diarized_json; он возвращает текст и сегменты с данными о том, кто и в какой момент говорил. Модель предназначена именно для API транскрибации, а не для генерации речи.

Когда полезно разделение по участникам

Интервью, встречи и разговоры

Разделение реплик помогает готовить черновики протоколов совещаний, расшифровки интервью и записи звонков. Оно не подтверждает личность человека: метка говорящего — техническая группировка речевых фрагментов внутри записи. Для важных документов стоит проверить, правильно ли сопоставлены реплики, особенно если голоса похожи или участники часто перебивают друг друга.

Поддержка в API

Планируемое прекращение работы модели

В августе 2026 года OpenAI включила GPT-4o Transcribe Diarize в список моделей, выводимых из API 26 февраля 2027 года. Для новых систем компания указывает GPT Transcribe и GPT Live Transcribe. Если проект уже использует diarized_json, перед миграцией нужно проверить, какой формат сегментации и метки говорящих доступен у модели-замены.

Связанные модели

Для сравнения возможностей и поколений посмотрите также: GPT-4o Transcribe; GPT Transcribe; GPT Live Transcribe.

Сведения о разработчике и его моделях: OpenAI в Вики Futuretools.ru.

Официальный источник: материал разработчика.