HunyuanImage 2.1
HunyuanImage 2.1 — открытая модель Tencent на 17 млрд параметров для генерации изображений высокого разрешения до 2K.
HunyuanImage 2.1 — открытая модель Tencent для генерации изображений по тексту. Версия содержит 17 млрд параметров и ориентирована на изображения разрешением до 2K. Код инференса и веса опубликованы 8 сентября 2025 года.
Генерация изображений до 2K
Двухэтапная схема с базовой моделью и уточнением
Официальный репозиторий описывает два этапа обработки: базовую text-to-image-модель и отдельный модуль уточнения результата. Для генерации высокого разрешения Tencent указывает квадратный формат 2048 × 2048 и другие соотношения сторон. Веса модели рассчитаны на локальный запуск с GPU.
Текст внутри изображения
Многоязычные запросы и обработка символов
В архитектуре используются мультимодальный языковой энкодер и энкодер, учитывающий символы. Tencent связывает их с улучшением соответствия изображения запросу и отображения текста на нескольких языках. Разработчик также публикует отдельную модель PromptEnhancer, но она не включена в базовые веса HunyuanImage 2.1.
Место в семействе
Предшествует HunyuanImage 3.0
Модель 2.1 выпущена 8 сентября 2025 года. Позднее Tencent опубликовала HunyuanImage 3.0, а затем отдельные варианты Instruct и Instruct Distil. Эти релизы отличаются поколением и не объединяются в одну карточку.
Дата выпуска и первичный источник
Подтверждённая запись разработчика
Официальный README датирует публикацию кода инференса и весов 08.09.2025; FP8-квантование 12 сентября не выделяется как отдельная модель. Источник: официальный источник Tencent.
Сведения о разработчике и его моделях: Tencent в Вики Futuretools.ru.