Voxtral Mini

Voxtral Mini — открытая модель Mistral AI на 3 млрд параметров для локального понимания аудио, транскрибации и текстовых запросов.

Voxtral Mini — компактная версия первой аудиомультимодальной модели Mistral, представленная 15 июля 2025 года. Модель на 3 млрд параметров принимает аудио и текст, имеет контекст 32 тысячи токенов и распространяется под Apache 2.0. Mistral ориентировала её на локальный и периферийный запуск.

Аудио и текст в одном запросе

Распознавание и вопросы по записи

Voxtral Mini предназначена не только для транскрибации: пользователь может передать запись и попросить модель ответить по её содержанию. Разработчик указывает обработку аудио до 30 минут для транскрибации или до 40 минут для понимания. Это разные режимы задачи, а доступная длина зависит от API или локального рантайма.

Компактный открытый формат

3 млрд параметров и Apache 2.0

Mini рассчитана на более доступное локальное размещение, чем 24-миллиардная Voxtral Small. Mistral опубликовала веса и добавила модель в API. Реальная скорость зависит от оборудования и выбранной точности; сам размер параметров не гарантирует конкретную задержку на устройстве.

Другие модели семейства

Small и версии транскрибации

Старшая модель — Voxtral Small. API-версия, специально настроенная на транскрибацию, описана как Voxtral Mini Transcribe. Для последующих задач доступны Mini Transcribe V2 и Realtime.

Дата выпуска и источник

Первичная публикация разработчика

Размер 3B, Apache 2.0, контекст 32K и заявленные пределы по длительности аудио указаны в анонсе Mistral от 15.07.2025. Источник: официальная публикация или документация Mistral AI.

Сведения о разработчике и его моделях: Mistral AI в Вики Futuretools.ru.