Description
Applique le Guidage d'Attention Normalisée (NAG) au modèle donné pendant l'inférence. Cette technique modifie le mécanisme d'attention pour réduire les artefacts et améliorer la qualité de génération, en particulier dans le contexte de la génération de vidéos longues avec LTXV. Ce nœud est basé sur l'approche décrite dans le référentiel Normalized-Attention-Guidance.
Entrées
| Nom | Type | Requis | Par défaut | Plage | Info-bulle / Description |
|---|---|---|---|---|---|
model | MODEL | Oui | — | — | Le modèle de diffusion d'entrée auquel appliquer NAG. |
nag_scale | FLOAT | Oui | 11.0 | 0.0 – 100.0 (step 0.001) | Force de l'effet de guidage négatif. Des valeurs plus élevées produisent une correction plus forte. |
nag_alpha | FLOAT | Oui | 0.25 | 0.0 – 1.0 (step 0.001) | Coefficient de mélange qui contrôle l'équilibre entre la représentation guidée normalisée et la représentation positive d'origine. |
nag_tau | FLOAT | Oui | 2.5 | 0.0 – 10.0 (step 0.001) | Seuil de clipping qui limite l'écart possible de l'attention guidée par rapport à l'attention positive. |
nag_cond_video | CONDITIONING | Non | — | — | Conditionnement vidéo optionnel pour guider la normalisation de l'attention. |
nag_cond_audio | CONDITIONING | Non | — | — | Conditionnement audio optionnel pour guider la normalisation de l'attention. |
inplace | BOOLEAN | Non | Vrai | — | Si activé, modifie les tenseurs en place pour économiser de la mémoire. Peut produire des résultats numériques légèrement différents par rapport aux opérations hors place. |
Sorties
| Nom | Type | Description |
|---|---|---|
model | MODEL | Le même modèle avec NAG appliqué à ses opérations d'attention internes. |
Notes d'utilisation
- Ce nœud est destiné à être utilisé avec le pipeline de génération vidéo LTXV (catégorie
KJNodes/ltxv). Il modifie le chemin avant du modèle, il doit donc être connecté avant le processus d'échantillonnage. - Les trois paramètres (
nag_scale,nag_alpha,nag_tau) contrôlent ensemble le comportement du guidage. Commencez par les valeurs par défaut et ajustez en fonction de la qualité visuelle – augmenternag_scaleréduit généralement la surexposition et les artefacts, tandis quenag_alphaetnag_tauaffinent la normalisation. nag_cond_videoetnag_cond_audiosont optionnels. Lorsqu'ils sont fournis, ils apportent des signaux de conditionnement supplémentaires qui influencent la normalisation de l'attention. Laissez-les déconnectés si vous ne souhaitez pas un tel conditionnement.- Activer
inplace(par défaut) réduit l'utilisation de la mémoire pendant l'inférence. Si vous observez des incohérences numériques entre les exécutions ou si vous avez besoin d'une reproductibilité exacte, réglezinplacesurfaux.
Commentaires
Connectez-vous avec GitHub pour rejoindre la discussion.