Voxtral Mini
Voxtral Mini — открытая модель Mistral AI на 3 млрд параметров для локального понимания аудио, транскрибации и текстовых запросов.
Voxtral Mini — компактная версия первой аудиомультимодальной модели Mistral, представленная 15 июля 2025 года. Модель на 3 млрд параметров принимает аудио и текст, имеет контекст 32 тысячи токенов и распространяется под Apache 2.0. Mistral ориентировала её на локальный и периферийный запуск.
Аудио и текст в одном запросе
Распознавание и вопросы по записи
Voxtral Mini предназначена не только для транскрибации: пользователь может передать запись и попросить модель ответить по её содержанию. Разработчик указывает обработку аудио до 30 минут для транскрибации или до 40 минут для понимания. Это разные режимы задачи, а доступная длина зависит от API или локального рантайма.
Компактный открытый формат
3 млрд параметров и Apache 2.0
Mini рассчитана на более доступное локальное размещение, чем 24-миллиардная Voxtral Small. Mistral опубликовала веса и добавила модель в API. Реальная скорость зависит от оборудования и выбранной точности; сам размер параметров не гарантирует конкретную задержку на устройстве.
Другие модели семейства
Small и версии транскрибации
Старшая модель — Voxtral Small. API-версия, специально настроенная на транскрибацию, описана как Voxtral Mini Transcribe. Для последующих задач доступны Mini Transcribe V2 и Realtime.
Дата выпуска и источник
Первичная публикация разработчика
Размер 3B, Apache 2.0, контекст 32K и заявленные пределы по длительности аудио указаны в анонсе Mistral от 15.07.2025. Источник: официальная публикация или документация Mistral AI.
Сведения о разработчике и его моделях: Mistral AI в Вики Futuretools.ru.