Nemotron Nano 2 9B v2

Nemotron Nano 2 9B v2 — открытая модель NVIDIA с гибридной архитектурой Mamba-Transformer, рассуждением и контекстом 128 тысяч токенов.

Nemotron Nano 2 9B v2 — компактная рассуждающая модель NVIDIA, выпущенная 18 августа 2025 года. Она сочетает слои Mamba и Transformer, рассчитана на задачи с длинным контекстом и опубликована с окном до 128 тысяч токенов. NVIDIA сообщала о сравнительной производительности на одной A10G, но эти результаты относятся к тестовой конфигурации компании.

Гибридная архитектура

Сочетание Mamba и Transformer

Вместо одной только стандартной трансформерной схемы Nano 2 использует гибридную архитектуру, направленную на снижение вычислительной нагрузки при сохранении качества рассуждений. В опубликованном сравнении NVIDIA указывала, что модель сопоставима или превосходит Qwen3 8B на отдельных сложных тестах и может обеспечивать до шести раз большую пропускную способность на одной A10G. Это не универсальный коэффициент для всех задач и GPU.

Окно контекста и опубликованные варианты

9B reasoning, 9B base и 12B base

Материалы NVIDIA перечисляют три модели: выровненную и прореженную 9B reasoning-версию, 9B Base и 12B Base до настройки и прореживания. Для всех указано контекстное окно до 128K. В этой карточке рассматривается основная версия 9B v2; базовые веса — связанные контрольные точки, а не новые поколения модели.

Другие версии Nano

Текстовая и визуальная обработка

Для анализа документов NVIDIA выпустила отдельную визуальную модель Nemotron Nano 2 VL 12B. Предыдущее поколение рассуждающей модели представлено страницей Llama Nemotron Nano 8B; более новая мультимодальная версия — Nemotron 3 Nano Omni.

Дата выпуска и первичный источник

Подтверждение NVIDIA

Страница NVIDIA ADLR датирована 18.08.2025; в ней описаны гибрид Mamba-Transformer, окно 128K и три выпускаемых варианта весов, включая Nemotron Nano 9B v2 reasoning-модель. Официальный материал: NVIDIA.

Сведения о разработчике и его моделях: NVIDIA в Вики Futuretools.ru.