Mixtral 8x22B

Mixtral 8x22B — открытая модель Mistral AI на 141 млрд параметров, из которых активно 39 млрд; окно контекста — 64 тысячи токенов.

Mixtral 8x22B — открытая модель Mistral AI с разреженной архитектурой смеси экспертов, выпущенная 17 апреля 2024 года. В ней 141 млрд параметров, но при генерации одного токена активируются 39 млрд. Разработчик указал контекст 64 тысячи токенов, Apache 2.0 и поддержку функции вызова инструментов.

Разреженная архитектура

141 млрд параметров и 39 млрд активных

Общая ёмкость модели задаётся 141 млрд параметров, а вычисления на каждом шаге используют ограниченную часть экспертных блоков. Это повышает требование к памяти для хранения весов, хотя вычислительная нагрузка на токен определяется активными экспертами. Mistral подчёркивала такую разницу в официальной публикации.

Контекст и назначение

64K для крупных документов и кода

Окно 64K позволяет включать в запрос длинные материалы и больше контекста проекта. В официальном анонсе Mistral отдельно отмечает английский, французский, итальянский, немецкий и испанский языки, математические и кодовые задачи, а также нативный вызов функций. Эти возможности не превращают модель в автономного агента: приложения и доступ к инструментам задаются внешней системой.

Линейка Mixtral

Меньший вариант 8x7B

Предшествующая модель семейства — Mixtral 8x7B с 47B общих и 13B активных параметров. Оба выпуска относятся к самостоятельным именованным версиям Mixtral. Для новых общих сценариев Mistral указывает более поздние модели, включая Mistral Large 3.

Дата выпуска и источник

Что подтверждают материалы разработчика

Анонс Mistral от 17.04.2024 подтверждает 141B/39B, контекст 64K, Apache 2.0, мультиязычность и нативный function calling; API-модель впоследствии была retired 30.03.2025. Первичный источник: официальная публикация или карточка Mistral AI.

Сведения о разработчике и его моделях: Mistral AI в Вики Futuretools.ru.