Sparrow-2

Модель Tavus для потокового распознавания диалоговой сцены, очередности реплик, перебиваний и реплик-подтверждений.

Понимание диалога в реальном времени

Sparrow-2 от Tavus — потоковая аудиомодель, которая совместно обрабатывает смену говорящих, перебивания, реплики-подтверждения и акустическую сцену. На частоте 10 мс модель определяет, когда слушать, ждать, начинать говорить или продолжать реплику.

Работа в шумных пространствах

Модель рассчитана на шумную среду с несколькими говорящими и разделение голосов в общем звуковом потоке. Это позволяет использовать разговорный ИИ в киосках, магазинах, автомобилях и других общих пространствах.

Доступ через Tavus

Sparrow-2 доступна через API Tavus и используется в Tavus PALs. Для неё заявлен показатель сбоев диалога 2,1%, почти в четыре раза ниже, чем у сопоставимых альтернатив. Интерактивная демонстрация позволяет поговорить с PAL и наблюдать за распознаванием сцены в реальном времени.