Llama Nemotron Super 49B
Llama Nemotron Super 49B — модель рассуждения NVIDIA, дистиллированная из Llama 3.3 70B и рассчитанная на высокую производительность на одном GPU.
Llama Nemotron Super 49B — открытая рассуждающая модель NVIDIA, объявленная в семействе Llama Nemotron 18 марта 2025 года. Она создана на основе Llama 3.3 70B и уменьшена до 49 млрд параметров с помощью поиска архитектуры и дистилляции. NVIDIA позиционировала Super для сценариев, где нужна высокая точность, но доступен один ускоритель для инференса.
Баланс между качеством и вычислениями
Дистилляция модели Llama 3.3 70B
Super использует знания более крупной модели, но имеет собственную архитектуру. NVIDIA применяла Neural Architecture Search и дистилляцию, чтобы снизить вычислительную стоимость и ускорить генерацию. Версия на 49 млрд параметров предназначена для серверного запуска и не является лёгкой моделью для обычного ноутбука без специализированной видеокарты.
Инструменты и режим рассуждения
Задачи планирования и вызова функций
В техническом описании NVIDIA рассматриваются математические и программные задачи, следование инструкциям, вызов функций и взаимодействие с инструментами. Модель может работать в режимах с рассуждением и без него. В компании также описывали многоагентный сценарий, где несколько экземпляров модели предлагают, проверяют и редактируют варианты ответа; это отдельная схема применения, а не автоматическое свойство каждого одиночного запроса.
Версии Super и соседние модели
Первый релиз и обновление v1.5
Базовый релиз семейства вышел вместе с Nano 8B; для наиболее вычислительно требовательных задач предназначена Ultra 253B. В июле 2025 года NVIDIA выпустила отдельное обновление Super 49B v1.5.
Дата выпуска и первичный источник
Подтверждение NVIDIA
NVIDIA датирует запуск семейства 18.03.2025; технический обзор семейства описывает Super как 49B-модель, дистиллированную из Llama 3.3 70B и оптимизированную под одиночный GPU. Официальный материал: NVIDIA.
Сведения о разработчике и его моделях: NVIDIA в Вики Futuretools.ru.