MiniMax Speech 2.6
Speech 2.6 улучшила задержку и распознавание форматированных данных в синтезе речи для голосовых агентов.
MiniMax объявила Speech 2.6 30 октября 2025 года. Обновление было адресовано голосовым агентам и, по формулировке компании, объединило меньшую задержку, улучшенную обработку форматированных данных и более естественное звучание.
Синтез для диалогового интерфейса
В первичной публикации MiniMax приводит задержку менее 250 миллисекунд в заявленном сценарии и улучшения при озвучивании адресов, ссылок, дат, чисел и денежных сумм. Это особенно важно для голосового интерфейса, где неверное чтение номера или суммы меняет смысл ответа.
Оценивать нужно весь аудиоканал
Фактическое время ответа складывается не только из генерации модели, но и из сетевого обмена, синтеза потока и воспроизведения. Поэтому цифра из анонса не гарантирует такую же задержку в любой интеграции.
Линейка синтеза речи
Предыдущая версия расширила языковую поддержку, а Speech 2.8 добавила теги звуковых нюансов. Смотрите Speech 2.5 Speech 2.8 Speech-02-Turbo
Другие выпуски MiniMax собраны на странице разработчика в Вики Futuretools.ru.
Дата и сведения сверены с официальной публикацией MiniMax. Предел задержки менее 250 мс цитирует заявленный MiniMax сценарий, а не измерение на инфраструктуре Futuretools.ru.