Nemotron Nano 2 9B v2
Nemotron Nano 2 9B v2 — открытая модель NVIDIA с гибридной архитектурой Mamba-Transformer, рассуждением и контекстом 128 тысяч токенов.
Nemotron Nano 2 9B v2 — компактная рассуждающая модель NVIDIA, выпущенная 18 августа 2025 года. Она сочетает слои Mamba и Transformer, рассчитана на задачи с длинным контекстом и опубликована с окном до 128 тысяч токенов. NVIDIA сообщала о сравнительной производительности на одной A10G, но эти результаты относятся к тестовой конфигурации компании.
Гибридная архитектура
Сочетание Mamba и Transformer
Вместо одной только стандартной трансформерной схемы Nano 2 использует гибридную архитектуру, направленную на снижение вычислительной нагрузки при сохранении качества рассуждений. В опубликованном сравнении NVIDIA указывала, что модель сопоставима или превосходит Qwen3 8B на отдельных сложных тестах и может обеспечивать до шести раз большую пропускную способность на одной A10G. Это не универсальный коэффициент для всех задач и GPU.
Окно контекста и опубликованные варианты
9B reasoning, 9B base и 12B base
Материалы NVIDIA перечисляют три модели: выровненную и прореженную 9B reasoning-версию, 9B Base и 12B Base до настройки и прореживания. Для всех указано контекстное окно до 128K. В этой карточке рассматривается основная версия 9B v2; базовые веса — связанные контрольные точки, а не новые поколения модели.
Другие версии Nano
Текстовая и визуальная обработка
Для анализа документов NVIDIA выпустила отдельную визуальную модель Nemotron Nano 2 VL 12B. Предыдущее поколение рассуждающей модели представлено страницей Llama Nemotron Nano 8B; более новая мультимодальная версия — Nemotron 3 Nano Omni.
Дата выпуска и первичный источник
Подтверждение NVIDIA
Страница NVIDIA ADLR датирована 18.08.2025; в ней описаны гибрид Mamba-Transformer, окно 128K и три выпускаемых варианта весов, включая Nemotron Nano 9B v2 reasoning-модель. Официальный материал: NVIDIA.
Сведения о разработчике и его моделях: NVIDIA в Вики Futuretools.ru.