MiniMax Speech-01

Speech-01 — ранняя речевая модель MiniMax для синтеза выразительного многоязычного голоса и клонирования речи.

Speech-01 — модель генерации речи MiniMax для синтеза голоса с интонацией и эмоциональной окраской. Самая ранняя найденная официальная публикация, прямо называющая Speech-01, датирована 20 июня 2024 года; MiniMax сообщает, что её речевая модель обслуживала корпоративных клиентов с ноября 2023 года. В августе компания использовала для обновлённой версии также имя abab-speech-1.

Синтез речи и настройка голоса

В публикации июня 2024 года MiniMax описывает применение модели для обучения языкам, голосовых помощников, разговорных продуктов и озвучивания. В более подробной карточке от 31 августа компания указывает поддержку 11 языков, эмоциональную подачу и клонирование голоса по короткому образцу.

Дата документа и имя обновлённой версии

Компания сообщает о работе речевой технологии с ноября 2023 года, но не указывает точный день запуска Speech-01. Поэтому 20 июня 2024 года — дата первой найденной публичной публикации, прямо называющей модель, а не утверждение о дне её первого промышленного использования. 31 августа MiniMax сообщила об обновлении речевой модели и назвала её abab-speech-1; источник не утверждает, что это было первое появление Speech-01.

Версии с более высоким качеством и скоростью

Позднее появились HD-вариант и серия Speech-02. Смотрите Speech-01-HD Speech-02 Speech-02-HD

Другие выпуски MiniMax собраны на странице разработчика в Вики Futuretools.ru.

Дата и сведения сверены с официальной публикацией MiniMax. Первая найденная публикация, прямо называющая Speech-01, датирована 20.06.2024; MiniMax сообщает об использовании речевой модели с ноября 2023 года без точного дня первоначального запуска. Публикация 31.08.2024 именует обновлённую модель abab-speech-1, а не отдельный новый выпуск.

Дополнительные сведения опубликованы MiniMax в подробной карточке Speech-01.

Дополнительные сведения опубликованы MiniMax в сообщении об обновлении abab-speech-1.