HunyuanCustom

HunyuanCustom — мультимодальная модель Tencent для создания видео с заданным персонажем или визуальным объектом.

HunyuanCustom — модель Tencent для управляемой генерации видео. Она сочетает мультимодальные условия, включая изображения-референсы и текст, чтобы создавать ролик с заданным визуальным содержанием. Код инференса и веса опубликованы 9 мая 2025 года.

Контроль содержания ролика

Визуальные условия дополняют текстовый запрос

Название HunyuanCustom относится к архитектуре для генерации видео с заданными условиями. Пользователь задаёт текстовое описание и визуальный ориентир, а модель формирует видеоряд с учётом обоих входов. Это отличает её от базовой HunyuanVideo, предназначенной прежде всего для генерации по тексту.

Мультимодальная архитектура

Отдельная модельная линия внутри видеосемейства

Tencent описывает HunyuanCustom как мультимодальную архитектуру для персонализированной генерации видео на основе HunyuanVideo. В открытом репозитории опубликованы исходный код инференса, настройки и веса; фактическая поддержка входов определяется официальной инструкцией запуска.

Публикация и связанные модели

Открытые код и веса с 9 мая 2025 года

Дата выпуска подтверждена журналом официального репозитория HunyuanVideo. Рядом в семействе находятся HunyuanVideo-I2V, работающая с одним исходным изображением, и HunyuanVideo-Foley, создающая звуковое сопровождение к видео.

Дата выпуска и первичный источник

Подтверждённая запись разработчика

Дата — запись о выпуске HunyuanCustom в официальном журнале Tencent Hunyuan 09.05.2025. Источник: официальный источник Tencent.

Сведения о разработчике и его моделях: Tencent в Вики Futuretools.ru.