Qwen-Audio-3.0-Realtime-Plus

Qwen-Audio-3.0-Realtime-Plus — облачная модель Alibaba для двусторонних голосовых диалогов в реальном времени.

Qwen-Audio-3.0-Realtime-Plus — модель Alibaba для непрерывного разговора голосом. Она принимает аудио в режиме реального времени и формирует речевой ответ, поддерживая чередование реплик без отдельного запуска новой текстовой сессии для каждого сообщения. QwenCloud объявила модель 10 августа 2026 года.

Речь и двусторонний диалог

Потоковый обмен репликами

Руководство QwenCloud описывает Realtime API для голосовых помощников и разговорных интерфейсов. Приложение передаёт аудио, управляет сессией и получает речевые ответы. Модель обрабатывает запрос в рамках настроенной интеграции; она не подключается к микрофону или пользовательскому устройству самостоятельно.

Голоса и подключение

Системные и клонированные варианты

Документация перечисляет несколько системных голосов и возможность использовать созданный через API голосовой профиль. Фактический набор голосов, языков и параметров зависит от сервиса и текущих ограничений. Для клонирования можно передать идентификатор голоса, созданный с разрешения владельца аудиоматериала.

Связанные голосовые модели

Realtime-диалог отличается от распознавания и синтеза

Realtime-Plus рассчитана на разговор с моделью. Для одного лишь распознавания речи есть отдельные ASR Streaming и файловые модели; для синтеза заранее заданного текста — Qwen-Audio-3.0-TTS-Plus. Более поздняя Qwen-Audio-3.1-Realtime-Plus относится к следующему обновлению аудиолинейки.

Дата запуска

Модель семейства Qwen Audio 3.0

QwenCloud датирует релиз Realtime-Plus 10 августа 2026 года. В той же записи компания объявила Realtime-Flash; открытая публикация весов для этих сервисов не заявлена.

Официальные источники: журнал моделей QwenCloud и руководство Qwen Audio Realtime.

Сведения о разработчике и его моделях: Alibaba в Вики Futuretools.ru.