Description
Ajoute plusieurs images guides d'un lot au latent aux indices d'image correspondants. Les images non noires (c'est-à-dire non nulles) du lot sont utilisées comme guides. Ce nœud fait partie du pipeline de conditionnement LTXV, permettant un contrôle fin de l'apparence par image en injectant des images de référence directement dans l'espace latent.
Entrées
| Nom | Type | Requis | Description |
|---|---|---|---|
positive | CONDITIONING | Oui | Tenseur de conditionnement positif (par exemple, provenant d'un encodeur de texte CLIP ou d'une autre configuration de conditionnement). |
negative | CONDITIONING | Oui | Tenseur de conditionnement négatif. |
vae | VAE | Oui | Modèle VAE utilisé pour encoder les images guides dans l'espace latent. |
latent | LATENT | Oui | Tenseur latent initial (par exemple, provenant d'un latent vide ou d'une étape LTXV précédente). |
images | IMAGE | Oui | Lot d'images. Les images non noires de ce lot sont traitées comme des guides et appliquées aux indices d'image correspondants. Les images noires (tous les canaux à zéro) sont ignorées. |
strength | FLOAT (0-10) | Oui | Facteur de force appliqué à toutes les images guides. Par défaut : 1.0. Des valeurs plus élevées augmentent l'influence des guides. |
Sorties
| Nom | Type | Description |
|---|---|---|
positive | CONDITIONING | Conditionnement positif mis à jour avec les informations des guides injectées. |
negative | CONDITIONING | Conditionnement négatif mis à jour avec les informations des guides injectées. |
latent | LATENT | Tenseur latent modifié contenant les ajustements par image injectés par les guides. |
Notes d'utilisation
- Le nœud s'attend à ce que le lot
imagesait le même nombre d'images que le tenseurlatent(ou au moins jusqu'au nombre d'images du latent). Chaque image non noire du lot est utilisée comme guide pour l'indice d'image correspondant. - Une image « noire » est définie comme une image dont tous les canaux de pixels sont nuls. Cela permet d'inclure des images « placeholders » dans le lot qui ne doivent contribuer aucun signal de guidage.
- Le paramètre
strengthmet à l'échelle uniformément la contribution encodée de tous les guides. Pour faire varier la force par guide, vous pouvez prétraiter les images (par exemple, les fusionner avec du noir) avant de les passer à ce nœud. - Ce nœud est destiné aux flux de travail basés sur LTXV où un contrôle précis par image via des images de référence est nécessaire, comme la génération vidéo cohérente par image ou l'animation stylisée.
- Les trois sorties doivent être connectées pour continuer le pipeline de conditionnement (généralement vers un échantillonneur ou d'autres nœuds LTXV). Les tenseurs de conditionnement mis à jour transportent les informations des guides, tandis que le latent contient la représentation spatialement modifiée.
Commentaires
Connectez-vous avec GitHub pour rejoindre la discussion.