HunyuanVideo v1.0: открытая модель генерации видео
Первая открытая модель генерации видео от Tencent. Основана на трансформере с 3D VAE, поддерживает T2V и I2V в 720p.
HunyuanVideo v1.0
VideoText-to-VideoImage-to-VideoПервая открытая модель генерации видео от Tencent. Diffusion Transformer с 3D VAE — генерация видео из текста и изображений в 720p. Для работы в нативном ComfyUI рекомендуется использовать разделённые файлы от Comfy-Org; для обёрток или GGUF-воркфлоу — пакеты от Kijai / city96.
| Разработчик | Tencent |
| Дата открытого анонса | Декабрь 2024 |
| Архитектура | Diffusion Transformer + 3D VAE |
| Лицензия | Открытые веса (см. LICENSE в репозитории HF) |
| Типичный вывод в ComfyUI | 720p T2V / I2V через пакеты Comfy-Org bf16 |
Guides and workflows related to this model series.
Полное руководство по рабочему процессу HunyuanVideo Image-to-Video GGUF, FP8 и нативной поддержке ComfyUI с примерами
Подробное руководство по использованию модели HunyuanVideo от Tencent в ComfyUI для генерации видео из изображений: настройка среды, установка моделей и инструкции по рабочему процессу
Руководство по рабочему процессу HunyuanVideo Text-to-Video и примеры
Подробное руководство по использованию модели Hunyuan Video от Tencent в ComfyUI для генерации видео из текста: настройка среды, установка моделей и инструкции по рабочему процессу
Комментарии
Войдите через GitHub, чтобы участвовать в обсуждении.