HunyuanImage 2.1

HunyuanImage 2.1 — открытая модель Tencent на 17 млрд параметров для генерации изображений высокого разрешения до 2K.

HunyuanImage 2.1 — открытая модель Tencent для генерации изображений по тексту. Версия содержит 17 млрд параметров и ориентирована на изображения разрешением до 2K. Код инференса и веса опубликованы 8 сентября 2025 года.

Генерация изображений до 2K

Двухэтапная схема с базовой моделью и уточнением

Официальный репозиторий описывает два этапа обработки: базовую text-to-image-модель и отдельный модуль уточнения результата. Для генерации высокого разрешения Tencent указывает квадратный формат 2048 × 2048 и другие соотношения сторон. Веса модели рассчитаны на локальный запуск с GPU.

Текст внутри изображения

Многоязычные запросы и обработка символов

В архитектуре используются мультимодальный языковой энкодер и энкодер, учитывающий символы. Tencent связывает их с улучшением соответствия изображения запросу и отображения текста на нескольких языках. Разработчик также публикует отдельную модель PromptEnhancer, но она не включена в базовые веса HunyuanImage 2.1.

Место в семействе

Предшествует HunyuanImage 3.0

Модель 2.1 выпущена 8 сентября 2025 года. Позднее Tencent опубликовала HunyuanImage 3.0, а затем отдельные варианты Instruct и Instruct Distil. Эти релизы отличаются поколением и не объединяются в одну карточку.

Дата выпуска и первичный источник

Подтверждённая запись разработчика

Официальный README датирует публикацию кода инференса и весов 08.09.2025; FP8-квантование 12 сентября не выделяется как отдельная модель. Источник: официальный источник Tencent.

Сведения о разработчике и его моделях: Tencent в Вики Futuretools.ru.