VibeVoice-ASR-Streaming-7B
ПровереноVibeVoice-ASR-Streaming-7B — старшая потоковая модель Microsoft для распознавания речи и говорящих.
ФримиумОткрыть
VibeVoice-ASR-Streaming-7B — старшая потоковая модель Microsoft для распознавания речи и говорящих.
VibeVoice-ASR-Streaming-1.5B расшифровывает речь по мере поступления аудио и поддерживает десять языков.
Seeduplex — голосовая модель ByteDance для естественного диалога с одновременным прослушиванием и ответом.
VibeVoice-ASR распознаёт длительную речь, связывает реплики с говорящими и расставляет временные отметки.
Seed LiveInterpret 2.0 — речевая модель ByteDance для синхронного перевода между китайским и английским языками.
Doubao Realtime Voice — сквозная голосовая модель ByteDance для естественных диалогов с низкой задержкой.