NVIDIA Nemotron-Labs-Diffusion 3B Instruct
Nemotron-Labs-Diffusion 3B Instruct — компактная инструкционная модель с авторегрессионным, диффузионным и смешанным режимами.
Nemotron-Labs-Diffusion 3B Instruct — инструкционно настроенная 3B-версия NVIDIA для диалоговых и текстовых задач. В официальной коллекции её репозиторий называется `Nemotron-Labs-Diffusion-3B`; NVIDIA относит его к чат-вариантам линейки. Благодаря единому набору весов модель может работать обычной последовательной генерацией, диффузионным заполнением блоков или в режиме self-speculation.
- Модель для запросов и диалога
- Инструкционный чекпойнт семейства
- Декодирование с уточнением блоков
- AR, diffusion и self-speculation
- Требования и условия использования
- Младшая текстовая конфигурация
- Связанные модели и разработчик
- Семейство Nemotron-Labs Diffusion
- Публичный выпуск и первичный источник
- Карточка модели NVIDIA
Модель для запросов и диалога
Инструкционный чекпойнт семейства
Эта версия предназначена для прямого взаимодействия по инструкциям. Она подходит для генерации текста и диалогового применения, где запрос задаёт задачу и ожидаемый формат ответа. Если нужно продолжить предобучение или самостоятельно настраивать базовую модель, в линейке есть Nemotron-Labs-Diffusion 3B Base. Суффикс Instruct в названии карточки Futuretools поясняет назначение, а официальный ID Hugging Face приведён выше.
Декодирование с уточнением блоков
AR, diffusion и self-speculation
В режиме AR модель генерирует текст по одному токену слева направо. В diffusion-режиме она заполняет блок токенов, итеративно уточняя предсказания. Self-speculation совмещает параллельную подготовку нескольких токенов с авторегрессионной проверкой. Такой выбор нужен для управления компромиссом между совместимостью, скоростью декодирования и требованиями к вычислениям; конкретный выигрыш зависит от движка и оборудования.
Требования и условия использования
Младшая текстовая конфигурация
3B — наименьший размер в опубликованной текстовой линейке 3B, 8B и 14B. При одинаковой точности весов у неё меньше параметров, чем у 8B Instruct и 14B Instruct; это не задаёт фиксированный минимум видеопамяти, поскольку он зависит также от контекста и реализации. Весами управляет NVIDIA Nemotron Open Model License.
Связанные модели и разработчик
Семейство Nemotron-Labs Diffusion
NVIDIA Nemotron-Labs-Diffusion 3B Base · NVIDIA Nemotron-Labs-Diffusion 8B Instruct · NVIDIA Nemotron-Labs-Diffusion 14B Instruct · NVIDIA в Вики Futuretools
Публичный выпуск и первичный источник
Карточка модели NVIDIA
В анонсе NVIDIA от 23.05.2026 указано, что семейство выпускается с base и instruction-tuned chat вариантами на 3B, 8B и 14B. Официальный репозиторий этого чекпойнта — `nvidia/Nemotron-Labs-Diffusion-3B`; он маркирован как текстовая модель. Анонс линейки: NVIDIA: Nemotron-Labs Diffusion. Чекпойнт: Nemotron-Labs-Diffusion-3B.