NVIDIA Nemotron-Labs-Diffusion 8B Instruct
Nemotron-Labs-Diffusion 8B Instruct — диалоговая модель для генерации текста в трёх режимах декодирования.
Nemotron-Labs-Diffusion 8B Instruct — инструкционно настроенная версия 8B, на которой NVIDIA подробно показывает потенциал три-режимной генерации. Репозиторий модели называется `Nemotron-Labs-Diffusion-8B`; в официальном анонсе он входит в набор chat-вариантов. Для одного и того же чекпойнта доступны обычное авторегрессионное продолжение, диффузионная генерация блоками и self-speculation.
- Результаты, приведённые NVIDIA
- Измерения зависят от задачи и платформы
- Как работают три режима
- Последовательный вывод, блоки и проверка черновика
- Выбор между 3B, 8B и 14B
- Средний размер текстовой линейки
- Связанные модели и разработчик
- Семейство Nemotron-Labs Diffusion
- Публичный выпуск и первичный источник
- Карточка модели NVIDIA
Результаты, приведённые NVIDIA
Измерения зависят от задачи и платформы
В анонсе NVIDIA сообщает, что 8B в diffusion-режиме достигала 2,6-кратного числа токенов на один прямой проход по сравнению с авторегрессионными моделями в выбранной методике. Self-speculation показала до 6-кратного и 6,4-кратного значения для двух вариантов алгоритма на тестах отчёта; также приведён результат 2,7-кратного ускорения на DGX Spark в конкретной конфигурации. Это лабораторные измерения автора, а не гарантия ускорения на любом оборудовании.
Как работают три режима
Последовательный вывод, блоки и проверка черновика
AR остаётся контрольным и совместимым режимом. В diffusion модель генерирует группу токенов, затем уточняет их по нескольким шагам. Self-speculation использует тот же чекпойнт для параллельного черновика и авторегрессионной верификации, совместно переиспользуя KV-кэш. Настройка режима происходит при инференсе, поэтому для сравнения важно учитывать нагрузку, длину ответа и используемую реализацию.
Выбор между 3B, 8B и 14B
Средний размер текстовой линейки
Инструкционная модель 8B крупнее 3B Instruct и меньше 14B Instruct. NVIDIA также выпустила соответствующий 8B Base для собственной адаптации. Текстовые веса распространяются по NVIDIA Nemotron Open Model License; проверить лицензионные ограничения следует до коммерческого развёртывания.
Связанные модели и разработчик
Семейство Nemotron-Labs Diffusion
NVIDIA Nemotron-Labs-Diffusion 8B Base · NVIDIA Nemotron-Labs-Diffusion 3B Instruct · NVIDIA Nemotron-Labs-Diffusion 14B Instruct · NVIDIA в Вики Futuretools
Публичный выпуск и первичный источник
Карточка модели NVIDIA
Анонс NVIDIA от 23.05.2026 описывает 8B instruction-tuned chat-вариант и публикует конкретные, привязанные к тестам показатели скорости AR/diffusion/self-speculation. Официальный репозиторий чекпойнта — `nvidia/Nemotron-Labs-Diffusion-8B`. Анонс линейки: NVIDIA: Nemotron-Labs Diffusion. Чекпойнт: Nemotron-Labs-Diffusion-8B.