HiPO 1.7B
HiPO 1.7B — компактная исследовательская модель Kwaipilot для адаптивного выбора глубины рассуждения.
HiPO 1.7B — компактный вариант исследовательской модели Kwaipilot с алгоритмом Hybrid Policy Optimization. Официальная карточка весов появилась в организации команды 31 октября 2025 года. Модель предназначена для экспериментов с выбором между ответом без длинного рассуждения и режимом пошагового анализа.
Версия меньшего размера
В карточке указано, что HiPO использует Qwen3-8B как базовую модель, а размер опубликованного варианта составляет 1,7 млрд параметров. Команда исследует, как обучить систему не включать рассуждение на простых запросах и сохранить его для задач, где оно повышает точность.
Пределы применения
Это открытая исследовательская модель, а не готовый коммерческий сервис. Результаты в карточке относятся к экспериментальному протоколу авторов и не заменяют независимую оценку на данных конкретного проекта. Для репозитория указана лицензия Apache 2.0.
Старший размер и связанная работа
Для сравнения команда также опубликовала HiPO 8B и техническое описание алгоритма. Перейдите к HiPO 8B KwaiCoder AutoThink Preview
Разработчик и источник
Выпуски Kuaishou и команды Kwaipilot собраны на странице разработчика в Вики Futuretools.ru.
Дата и характеристики сверены с официальной публикацией разработчика или карточкой модели. Дата — дата создания публичной официальной карточки модели; дата публикации исследования указывается отдельно в источниках.