MiniMax-VL-01
MiniMax-VL-01 — мультимодальная модель MiniMax для понимания визуального содержимого вместе с текстом.
MiniMax-VL-01 — визуальная мультимодальная модель из серии MiniMax-01. MiniMax объявила её 15 января 2025 года вместе с языковой MiniMax-Text-01 и сообщила об открытой публикации весов обеих моделей.
Понимание визуальных данных
Разработчик приводит отдельные результаты MiniMax-VL-01 на тестах мультимодального понимания. Это отделяет её назначение от MiniMax-Text-01, которая в анонсе описана как базовая языковая модель. Официальный материал не даёт оснований приписывать VL-01 все параметры Text-01, включая её размер и предел контекста.
Как использовать сравнительные результаты
Приведённые оценки отражают внутреннюю методику MiniMax и конкретные наборы данных. Для прикладного выбора важны тип изображений, качество распознавания текста, язык запросов и доступная вычислительная инфраструктура.
Другие модели MiniMax-01
Языковая модель этого выпуска и более поздняя модель длинного рассуждения собраны отдельно: MiniMax-Text-01 MiniMax M1
Другие выпуски MiniMax собраны на странице разработчика в Вики Futuretools.ru.
Дата и сведения сверены с официальной публикацией MiniMax. Дата соответствует выпуску серии MiniMax-01; отдельные количественные характеристики Text-01 к VL-01 не перенесены.