MiniMax-VL-01

MiniMax-VL-01 — мультимодальная модель MiniMax для понимания визуального содержимого вместе с текстом.

MiniMax-VL-01 — визуальная мультимодальная модель из серии MiniMax-01. MiniMax объявила её 15 января 2025 года вместе с языковой MiniMax-Text-01 и сообщила об открытой публикации весов обеих моделей.

Понимание визуальных данных

Разработчик приводит отдельные результаты MiniMax-VL-01 на тестах мультимодального понимания. Это отделяет её назначение от MiniMax-Text-01, которая в анонсе описана как базовая языковая модель. Официальный материал не даёт оснований приписывать VL-01 все параметры Text-01, включая её размер и предел контекста.

Как использовать сравнительные результаты

Приведённые оценки отражают внутреннюю методику MiniMax и конкретные наборы данных. Для прикладного выбора важны тип изображений, качество распознавания текста, язык запросов и доступная вычислительная инфраструктура.

Другие модели MiniMax-01

Языковая модель этого выпуска и более поздняя модель длинного рассуждения собраны отдельно: MiniMax-Text-01 MiniMax M1

Другие выпуски MiniMax собраны на странице разработчика в Вики Futuretools.ru.

Дата и сведения сверены с официальной публикацией MiniMax. Дата соответствует выпуску серии MiniMax-01; отдельные количественные характеристики Text-01 к VL-01 не перенесены.