Mistral Nemo 12B
Mistral Nemo 12B — открытая совместная модель Mistral AI и NVIDIA с контекстом 128 тысяч токенов и токенизатором Tekken.
Mistral Nemo 12B — открытая модель, которую Mistral AI и NVIDIA выпустили 18 июля 2024 года. Она содержит 12 млрд параметров, поддерживает контекст до 128 тысяч токенов и распространяется под Apache 2.0. Разработчики опубликовали базовые и инструкционно настроенные веса, включая версию для инференса FP8.
Многоязычный ввод
Токенизатор Tekken для текста и кода
Mistral Nemo использует Tekken — токенизатор, обученный более чем на ста языках. Компания сообщала о более эффективном сжатии исходного кода и нескольких языков по сравнению с прежним SentencePiece; русскому также уделено отдельное внимание. Это заявление разработчика о длине токенизированного текста, а не оценка точности перевода или генерации.
Контекст и запуск
12B, 128K и Apache 2.0
Модель сочетает контекст до 128K с опубликованными весами и стандартной архитектурой, что облегчает интеграцию в инфраструктуру для Mistral 7B. На обучении разработчик уделял внимание диалогу, следованию инструкциям и вызову функций. Для исполнения внешних команд требуется программная оболочка, которая предоставляет модели инструменты.
Место в портфеле
Мультимодальная ветка Pixtral и новые Ministral
На базе Mistral Nemo построен визуальный декодер Pixtral 12B. Для периферийного запуска рядом появились Ministral 3B и Ministral 8B. Более новые поколения Mistral Small описаны на страницах Small 3.0 и Small 4.
Дата выпуска и источник
Что подтверждают материалы разработчика
Анонс Mistral от 18.07.2024 подтверждает 12B, 128K, Apache 2.0, сотрудничество с NVIDIA и Tekken; отдельные base/instruct/FP8 файлы объединены, поскольку это форматы одного выпуска. Первичный источник: официальная публикация или карточка Mistral AI.
Сведения о разработчике и его моделях: Mistral AI в Вики Futuretools.ru.