Sparrow-2
Модель Tavus для потокового распознавания диалоговой сцены, очередности реплик, перебиваний и реплик-подтверждений.
Понимание диалога в реальном времени
Sparrow-2 от Tavus — потоковая аудиомодель, которая совместно обрабатывает смену говорящих, перебивания, реплики-подтверждения и акустическую сцену. На частоте 10 мс модель определяет, когда слушать, ждать, начинать говорить или продолжать реплику.
Работа в шумных пространствах
Модель рассчитана на шумную среду с несколькими говорящими и разделение голосов в общем звуковом потоке. Это позволяет использовать разговорный ИИ в киосках, магазинах, автомобилях и других общих пространствах.
Доступ через Tavus
Sparrow-2 доступна через API Tavus и используется в Tavus PALs. Для неё заявлен показатель сбоев диалога 2,1%, почти в четыре раза ниже, чем у сопоставимых альтернатив. Интерактивная демонстрация позволяет поговорить с PAL и наблюдать за распознаванием сцены в реальном времени.