Qwen-Audio-3.1-Realtime-Plus

Qwen-Audio-3.1-Realtime-Plus — облачная модель Alibaba для двустороннего голосового общения в реальном времени с контекстом до 262 144 токенов.

Qwen-Audio-3.1-Realtime-Plus — модель Alibaba для разговоров голосом в реальном времени. QwenCloud добавила её в журнал выпусков 20 сентября 2026 года. Модель рассчитана на двусторонний аудиодиалог: она принимает голос пользователя и отвечает речью, поддерживая непрерывный обмен репликами.

Что добавлено в версии 3.1

Голосовой диалог с инструментами и большим контекстом

В документации QwenCloud для версии указаны контекстное окно до 262 144 токенов, вызов функций, веб-поиск и клонирование голоса. Разработчик сообщает, что модель сохраняет голоса предыдущей версии и добавляет восемь системных голосов. Наличие этих возможностей зависит от API и конфигурации приложения; клонирование голоса следует включать только при наличии соответствующих прав на аудиоматериал.

Сценарии применения

Помощники, голосовые интерфейсы и разговорные системы

Модель можно оценивать для голосовых помощников, голосового обслуживания клиентов и других интерфейсов, где важен естественный обмен репликами без отдельных запросов после каждой фразы. Для обработки аудио и видео с изображением в реальном времени у Qwen есть мультимодальная Qwen3.8 Omni-Flash-Realtime; для синхронного перевода — Qwen3.8 LiveTranslate Flash Realtime.

Дата и доступность

Отдельная голосовая модель QwenCloud

QwenCloud датирует выпуск 20 сентября 2026 года. Это API-сервис Qwen Audio, а не очередная версия текстовой модели Qwen3.8. В каталоге QwenCloud следует проверять поддерживаемые протоколы, голоса, языки и лимиты перед интеграцией.

Официальные источники: журнал выпусков QwenCloud и руководство по моделям речи.

Сведения о разработчике и его моделях: Alibaba в Вики Futuretools.ru.