NVIDIA Nemotron-Labs-Diffusion 14B Instruct

Nemotron-Labs-Diffusion 14B Instruct — старшая диалоговая версия модели с тремя способами генерации текста.

Nemotron-Labs-Diffusion 14B Instruct — крупнейшая инструкционно настроенная текстовая модель семейства на момент опубликованной линейки. Она предназначена для запросов и диалоговой генерации, а декодирование может работать в трёх режимах: авторегрессионном, диффузионном и self-speculation. Официальный идентификатор чекпойнта — `nvidia/Nemotron-Labs-Diffusion-14B`; слово Instruct в заголовке Futuretools поясняет назначение модели.

Крупная инструкционная версия

14B внутри открытой линейки NVIDIA

NVIDIA выпустила чат-варианты на 3B, 8B и 14B. Старший размер может быть полезен при оценке задач, где важны более ёмкие языковые представления, но сам по себе не обещает превосходства на каждом тесте. Для сравнения доступна 8B Instruct, а разработчикам, планирующим собственное дообучение, — 14B Base.

Три режима для одного чекпойнта

Совместимость, параллельность и проверка

AR обеспечивает знакомое пошаговое декодирование. Diffusion генерирует блоки параллельно и обновляет токены в несколько итераций. Self-speculation сочетает параллельное черновое предсказание с авторегрессионной проверкой. Выбор может повлиять на задержку и пропускную способность, но сравнивать нужно при одинаковом бюджете качества, на той же задаче и аппаратуре.

Развёртывание и условия

Проверяйте ресурсы и лицензию

14B — самый крупный текстовый размер семейства, поэтому при одинаковой точности весов ему потребуется больше памяти, чем 8B и 3B. Реальные требования меняются при квантизации, длинном контексте и разных движках инференса. Текстовая модель распространяется на условиях NVIDIA Nemotron Open Model License. Для моделей, которые должны принимать изображения, есть отдельный Nemotron-Labs-Diffusion VLM 8B.

Связанные модели и разработчик

Семейство Nemotron-Labs Diffusion

NVIDIA Nemotron-Labs-Diffusion 14B Base · NVIDIA Nemotron-Labs-Diffusion 8B Instruct · NVIDIA Nemotron-Labs-Diffusion VLM 8B · NVIDIA в Вики Futuretools

Публичный выпуск и первичный источник

Карточка модели NVIDIA

Статья NVIDIA от 23.05.2026 объявляет инструкционно настроенную chat-линейку на 3B, 8B и 14B и описывает три режима декодирования. Чекпойнт 14B размещён в официальном репозитории `nvidia/Nemotron-Labs-Diffusion-14B`. Анонс линейки: NVIDIA: Nemotron-Labs Diffusion. Чекпойнт: Nemotron-Labs-Diffusion-14B.