KJNodes/hunyuanvideogenerated

HunyuanVideo Encode Keyframes To Cond(HunyuanVideoEncodeKeyframesToCond)

Ce nœud reçoit les images des trames de début et de fin en entrée, et les encode dans l'espace latent via le VAE (Variational Autoencoder) spécifié.

Hunyuan Video Encode Keyframes To Cond

model
positive
vae
start_frame
end_frame
negative
model
positive
negative
latent
num_frames
33
tile_size
512
overlap
64
temporal_size
64
temporal_overlap
8
KJNodes

Le nœud HunyuanVideo Encode Keyframes To Cond reçoit les images de la trame de début et de fin en entrée et les encode dans l'espace latent via un encodeur automatique variationnel (VAE) spécifié.

HunyuanVideo Encode Keyframes To Cond est un nœud conçu spécifiquement pour les flux de travail de génération vidéo. Sa fonction principale est de traiter les trames de début et de fin, de les encoder en représentations dans l'espace latent et de générer des informations de conditionnement pour guider le modèle vidéo. Ce nœud vise à fournir une base visuelle et conditionnelle initiale pour la génération de séquences vidéo.

Fonctionnalités du nœud

Ce nœud reçoit les images de la trame de début et de fin en entrée et les encode dans l'espace latent via un encodeur automatique variationnel (VAE) spécifié. Il prend en charge l'encodage par tuiles pour traiter les images haute résolution et permet de définir la taille des blocs d'encodage et la zone de chevauchement sur la dimension temporelle, ce qui est particulièrement important pour les VAE vidéo. Le nœud produit en sortie un modèle modifié, des informations de conditionnement positives et négatives, ainsi qu'un objet LATENT contenant la représentation latente encodée.

Explication des paramètres du nœud - HunyuanVideo Encode Keyframes To Cond

Entrées (Inputs)

Nom du paramètreType de donnéesRequisValeur par défautPlage/Valeurs possiblesDescription
modelMODELOui--model (paramètre d'entrée) : Modèle utilisé pour la génération vidéo.
positiveCONDITIONINGOui--positive (paramètre d'entrée) : Informations de conditionnement positives pour guider la génération.
vaeVAEOui--vae (paramètre d'entrée) : Encodeur automatique variationnel utilisé pour encoder l'image dans l'espace latent.
start_frameIMAGEOui--start_frame (paramètre d'entrée) : Image de la trame clé de début de la séquence vidéo.
end_frameIMAGEOui--end_frame (paramètre d'entrée) : Image de la trame clé de fin de la séquence vidéo.
negativeCONDITIONINGNon--negative (paramètre d'entrée) : Informations de conditionnement négatives facultatives.

Paramètres de contrôle (Parameters)

Nom du paramètreType de donnéesRequisValeur par défautPlage/Valeurs possiblesDescription
num_framesINTOui332 - 4096 (pas: 1)num_frames (paramètre d'entrée) : Spécifie le nombre total de trames à générer. Plage de 2 à 4096, pas de 1.
tile_sizeINTOui51264 - 4096 (pas: 64)tile_size (paramètre d'entrée) : Définit la taille de chaque tuile lors de l'encodage par tuiles. Plage de 64 à 4096, pas de 64.
overlapINTOui640 - 4096 (pas: 32)overlap (paramètre d'entrée) : Définit le nombre de pixels de chevauchement entre les tuiles lors de l'encodage par tuiles. Plage de 0 à 4096, pas de 32.
temporal_sizeINTOui648 - 4096 (pas: 4)Uniquement pour les VAE vidéo : Quantité de trames à encoder à la fois.
temporal_overlapINTOui84 - 4096 (pas: 4)Uniquement pour les VAE vidéo : Quantité de trames à chevaucher.

Sorties (Output)

Nom du paramètreType de donnéesDescription
modelMODELmodel (paramètre de sortie) : Modèle modifié et prêt à recevoir la condition des images clés.
positiveCONDITIONINGpositive (paramètre de sortie) : Informations de conditionnement positives traitées en sortie.
negativeCONDITIONINGnegative (paramètre de sortie) : Informations de conditionnement négatives traitées en sortie.
latentLATENTlatent (paramètre de sortie) : Représentation dans l'espace latent obtenue par l'encodage des trames de début et de fin.

Scénarios d'utilisation

Dans un flux de travail d'interpolation vidéo ou de génération de séquences vidéo à partir d'images clés, l'utilisateur peut placer ce nœud après le nœud de chargement du modèle. En connectant les images des trames clés de début et de fin et en définissant le nombre total de trames, ce nœud prépare les entrées de conditionnement nécessaires et l'état latent initial pour le modèle de génération vidéo ultérieur, guidant ainsi le modèle pour générer des trames intermédiaires cohérentes.

Points d'attention

Ce nœud impose des exigences sur la taille des images d'entrée et les redimensionnera automatiquement à un multiple de 8. Les paramètres temporal_size et temporal_overlap ne sont actifs que si le VAE utilisé est un VAE vidéo, et servent à contrôler le mode d'encodage sur la dimension temporelle.

Lien vers le code source du nœud HunyuanVideo Encode Keyframes To Cond

Le nœud HunyuanVideo Encode Keyframes To Cond provient du pack de nœuds ComfyUI-KJNodes.

Commentaires

Connectez-vous avec GitHub pour rejoindre la discussion.

Chargement des commentaires…