DeepSeek-V3.2-Exp

Экспериментальная модель DeepSeek с разреженным вниманием для более эффективной работы с длинным контекстом.

DeepSeek представила V3.2-Exp 29 сентября 2025 года как экспериментальную промежуточную модель. Она построена на V3.1-Terminus и вводит механизм DeepSeek Sparse Attention для изучения более экономичной обработки длинных последовательностей.

Разреженное внимание для длинного контекста

DeepSeek описывает DSA как способ выбирать нужные части контекста вместо полного вычисления внимания по всей последовательности. Компания заявила о снижении вычислительных затрат и сопоставимом с V3.1-Terminus качестве на приведённых ею тестах.

Экспериментальный статус

В названии и официальном анонсе явно использовано слово Exp. Релиз предназначался для проверки исследовательской архитектуры, а не как полноценное следующее поколение; позже DeepSeek объявила V3.2 и V3.2-Speciale.

Связанные версии

Откройте предшествующую V3.1-Terminus и полноценные версии V3.2: V3.1-Terminus DeepSeek-V3.2 V3.2-Speciale

Другие выпуски DeepSeek собраны на странице разработчика в Вики Futuretools.ru.

Дата и сведения сверены с официальным источником DeepSeek. Дата релиза и описание DSA сверены с официальным анонсом DeepSeek от 29.09.2025; тесты атрибутированы компании.