Llama Embed Nemotron 8B

Llama Embed Nemotron 8B превращает тексты в векторы для поиска, ранжирования и многоязычных систем RAG.

Llama Embed Nemotron 8B — текстовая модель встраиваний NVIDIA для поиска по документам и систем генерации ответов с извлечением контекста. Официальная карточка датирует выпуск 21 октября 2025 года. Модель преобразует запросы и фрагменты документов в векторы, чтобы система могла находить близкие по смыслу тексты даже при различии формулировок и языков.

Векторный поиск и RAG

Сопоставление запроса с документами по смыслу

Вместо генерации ответа модель кодирует текст в числовое представление. Система сохраняет векторы документов, кодирует запрос и ищет наиболее близкие фрагменты; найденный контекст затем может быть передан отдельной языковой модели. NVIDIA указывает сценарии извлечения информации, повторного ранжирования, семантического сходства и классификации.

Основа и лицензия

Многоязычная модель исследовательского назначения

Модель основана на Llama 3.1 8B с двунаправленным вниманием и содержит около 7,5 млрд параметров. NVIDIA сообщает о поддержке многоязычного и межъязыкового поиска. Карточка обозначает исследовательскую и некоммерческую лицензию; перед использованием в коммерческой системе необходимо проверить условия именно той версии весов, которую планируется применять.

Смежные модели поиска

Текстовые и мультимодальные индексы

Для поиска по изображениям страниц и визуальным документам предназначена пара Llama Nemotron Embed VL и Llama Nemotron Rerank VL. В текстовом производственном поиске NVIDIA также публикует более компактные модели эмбеддингов и переранжирования; каждую из них следует выбирать по типу документа, метрике поиска и лицензии.

Связанные модели и разработчик

Карточки экосистемы NVIDIA

Llama Nemotron Embed VL 1B v2 · Llama Nemotron Rerank VL 1B v2 · nemotron 3 super 120b · NVIDIA в Вики Futuretools

Дата выпуска и официальный источник

Что подтверждают материалы разработчика

Карточка NVIDIA указывает выпуск 21.10.2025, около 7,5 млрд параметров, основу Llama 3.1 8B с двунаправленным вниманием и текстовые сценарии векторного поиска. В карточке указано ограничение на некоммерческое/исследовательское применение. Первичный источник: официальные материалы NVIDIA.