KJNodes/ltxvgenerated

LTX2 Audio Latent Normalizing Sampling(LTX2AudioLatentNormalizingSampling)

通过归一所选采样步骤的音频 Latent 来改善 LTX2 已生成音频质量。

LTX2 Audio Latent Normalizing Sampling

model
MODEL
audio_normalization_factors
1,1,0.25,1,1,0.25,1,1
KJNodes

描述

LTX2 Audio Latent Normalizing Sampling 节点通过应用每步归一化到音频 Latent(在采样过程中)来改善由 LTX2 模型生成的音频质量。这有助于减少伪影并提高连贯性,尤其对于较长的音频生成。

输入

  • modelMODEL,必填)
    将添加音频归一化覆盖的 LTX2 模型。

  • audio_normalization_factorsSTRING,必填,默认:"1,1,0.25,1,1,0.25,1,1"
    一个以逗号分隔的归一化因子列表,每个因子对应一个采样步。每个因子缩放该步的音频 Latent。
    例如,默认值 "1,1,0.25,1,1,0.25,1,1" 在第 3 步和第 6 步(从 1 开始计数)应用因子 0.25,衰减这些步的 Latent。因子可以是任意正浮点;小于 1 的值降低 Latent 幅度,大于 1 的值放大它。
    列表长度应与生成流程中使用的总采样步数匹配。如果更长,多余的值被忽略;如果更短,最后一个值重复用于剩余步。

输出

  • MODEL
    返回一个附加了归一化行为的修改后模型。将此模型传递给标准采样工作流;归一化因子将在每个采样步自动应用。

使用说明

  • 此节点旨在与 KJNodes/ltxv 类别中的 LTX2 音频模型一起使用。
  • 归一化因子 额外 应用于采样器已执行的任何默认 Latent 缩放上。它们起到音频 Latent 上每步增益调整的作用。
  • 尝试不同的因子序列有助于减少高频噪波、稳定音量或强调特定时间区域。
  • 如果不确定使用哪些因子,默认序列(1,1,0.25,1,1,0.25,1,1)是典型 8 步采样调度的良好起点。对于更长的序列,相应调整模式。
  • 此节点不改变总步数;它只覆盖采样器迭代期间的音频 Latent 行为。

评论

使用 GitHub 登录后即可参与讨论。

评论加载中…
LTX2 Audio Latent Normalizing Sampling (LTX2AudioLatentNormalizingSampling) - ComfyUI-KJNodes | ComfyUI Wiki