KJNodes/ltxvgenerated

Échantillonnage de normalisation latente audio LTX2(LTX2AudioLatentNormalizingSampling)

Améliore la qualité audio générée par LTX2 en normalisant les latences audio à des étapes d'échantillonnage spécifiées.

LTX2 Audio Latent Normalizing Sampling

model
MODEL
audio_normalization_factors
1,1,0.25,1,1,0.25,1,1
KJNodes

Description

Le nœud LTX2 Audio Latent Normalizing Sampling améliore la qualité de l'audio généré par les modèles LTX2 en appliquant une normalisation par étape aux latences audio lors du processus d'échantillonnage. Cela permet de réduire les artefacts et d'améliorer la cohérence, en particulier pour les générations audio plus longues.

Entrées

  • model (MODEL, Requis)
    Le modèle LTX2 auquel le remplacement de la normalisation audio sera ajouté.

  • audio_normalization_factors (STRING, Requis, par défaut : "1,1,0.25,1,1,0.25,1,1")
    Une liste de facteurs de normalisation séparés par des virgules, un par étape d'échantillonnage. Chaque facteur met à l'échelle la latence audio à cette étape.
    Par exemple, la valeur par défaut "1,1,0.25,1,1,0.25,1,1" applique un facteur de 0.25 aux étapes 3 et 6 (en commençant à 1), atténuant la latence à ces étapes. Les facteurs peuvent être n'importe quel flottant positif ; les valeurs inférieures à 1 réduisent la magnitude de la latence, les valeurs supérieures à 1 l'amplifient.
    La longueur de la liste doit correspondre au nombre total d'étapes d'échantillonnage utilisées dans le pipeline de génération. Si elle est plus longue, les valeurs supplémentaires sont ignorées ; si elle est plus courte, la dernière valeur est répétée pour les étapes restantes.

Sorties

  • MODEL
    Renvoie un modèle modifié avec le comportement de normalisation attaché. Passez ce modèle dans un flux de travail d'échantillonnage standard ; les facteurs de normalisation seront appliqués automatiquement à chaque étape d'échantillonnage.

Notes d'utilisation

  • Ce nœud est destiné à être utilisé avec les modèles audio LTX2 de la catégorie KJNodes/ltxv.
  • Les facteurs de normalisation sont appliqués en plus de toute mise à l'échelle latente par défaut déjà effectuée par l'échantillonneur. Ils agissent comme un ajustement de gain par étape sur la latence audio.
  • Expérimenter avec différentes séquences de facteurs peut aider à réduire le bruit haute fréquence, stabiliser le volume ou mettre en emphase certaines régions temporelles.
  • Si vous ne savez pas quels facteurs utiliser, la séquence par défaut (1,1,0.25,1,1,0.25,1,1) est un bon point de départ pour un programme d'échantillonnage typique de 8 étapes. Pour des séquences plus longues, ajustez le motif en conséquence.
  • Le nœud ne change pas le nombre total d'étapes ; il remplace uniquement le comportement de la latence audio lors des itérations de l'échantillonneur.

Commentaires

Connectez-vous avec GitHub pour rejoindre la discussion.

Chargement des commentaires…
Échantillonnage de normalisation latente audio LTX2 (LTX2AudioLatentNormalizingSampling) - ComfyUI-KJNodes | ComfyUI Wiki