HiPO 1.7B

HiPO 1.7B — компактная исследовательская модель Kwaipilot для адаптивного выбора глубины рассуждения.

HiPO 1.7B — компактный вариант исследовательской модели Kwaipilot с алгоритмом Hybrid Policy Optimization. Официальная карточка весов появилась в организации команды 31 октября 2025 года. Модель предназначена для экспериментов с выбором между ответом без длинного рассуждения и режимом пошагового анализа.

Версия меньшего размера

В карточке указано, что HiPO использует Qwen3-8B как базовую модель, а размер опубликованного варианта составляет 1,7 млрд параметров. Команда исследует, как обучить систему не включать рассуждение на простых запросах и сохранить его для задач, где оно повышает точность.

Пределы применения

Это открытая исследовательская модель, а не готовый коммерческий сервис. Результаты в карточке относятся к экспериментальному протоколу авторов и не заменяют независимую оценку на данных конкретного проекта. Для репозитория указана лицензия Apache 2.0.

Старший размер и связанная работа

Для сравнения команда также опубликовала HiPO 8B и техническое описание алгоритма. Перейдите к HiPO 8B KwaiCoder AutoThink Preview

Разработчик и источник

Выпуски Kuaishou и команды Kwaipilot собраны на странице разработчика в Вики Futuretools.ru.

Дата и характеристики сверены с официальной публикацией разработчика или карточкой модели. Дата — дата создания публичной официальной карточки модели; дата публикации исследования указывается отдельно в источниках.