Qwen-Audio-3.1-Realtime-Plus
Qwen-Audio-3.1-Realtime-Plus — облачная модель Alibaba для двустороннего голосового общения в реальном времени с контекстом до 262 144 токенов.
Qwen-Audio-3.1-Realtime-Plus — модель Alibaba для разговоров голосом в реальном времени. QwenCloud добавила её в журнал выпусков 20 сентября 2026 года. Модель рассчитана на двусторонний аудиодиалог: она принимает голос пользователя и отвечает речью, поддерживая непрерывный обмен репликами.
Что добавлено в версии 3.1
Голосовой диалог с инструментами и большим контекстом
В документации QwenCloud для версии указаны контекстное окно до 262 144 токенов, вызов функций, веб-поиск и клонирование голоса. Разработчик сообщает, что модель сохраняет голоса предыдущей версии и добавляет восемь системных голосов. Наличие этих возможностей зависит от API и конфигурации приложения; клонирование голоса следует включать только при наличии соответствующих прав на аудиоматериал.
Сценарии применения
Помощники, голосовые интерфейсы и разговорные системы
Модель можно оценивать для голосовых помощников, голосового обслуживания клиентов и других интерфейсов, где важен естественный обмен репликами без отдельных запросов после каждой фразы. Для обработки аудио и видео с изображением в реальном времени у Qwen есть мультимодальная Qwen3.8 Omni-Flash-Realtime; для синхронного перевода — Qwen3.8 LiveTranslate Flash Realtime.
Дата и доступность
Отдельная голосовая модель QwenCloud
QwenCloud датирует выпуск 20 сентября 2026 года. Это API-сервис Qwen Audio, а не очередная версия текстовой модели Qwen3.8. В каталоге QwenCloud следует проверять поддерживаемые протоколы, голоса, языки и лимиты перед интеграцией.
Официальные источники: журнал выпусков QwenCloud и руководство по моделям речи.
Сведения о разработчике и его моделях: Alibaba в Вики Futuretools.ru.