描述
LTX2 Audio Latent Normalizing Sampling 节点通过应用每步归一化到音频 Latent(在采样过程中)来改善由 LTX2 模型生成的音频质量。这有助于减少伪影并提高连贯性,尤其对于较长的音频生成。
输入
-
model(
MODEL,必填)
将添加音频归一化覆盖的 LTX2 模型。 -
audio_normalization_factors(
STRING,必填,默认:"1,1,0.25,1,1,0.25,1,1")
一个以逗号分隔的归一化因子列表,每个因子对应一个采样步。每个因子缩放该步的音频 Latent。
例如,默认值"1,1,0.25,1,1,0.25,1,1"在第 3 步和第 6 步(从 1 开始计数)应用因子0.25,衰减这些步的 Latent。因子可以是任意正浮点;小于 1 的值降低 Latent 幅度,大于 1 的值放大它。
列表长度应与生成流程中使用的总采样步数匹配。如果更长,多余的值被忽略;如果更短,最后一个值重复用于剩余步。
输出
MODEL
返回一个附加了归一化行为的修改后模型。将此模型传递给标准采样工作流;归一化因子将在每个采样步自动应用。
使用说明
- 此节点旨在与
KJNodes/ltxv类别中的 LTX2 音频模型一起使用。 - 归一化因子 额外 应用于采样器已执行的任何默认 Latent 缩放上。它们起到音频 Latent 上每步增益调整的作用。
- 尝试不同的因子序列有助于减少高频噪波、稳定音量或强调特定时间区域。
- 如果不确定使用哪些因子,默认序列(
1,1,0.25,1,1,0.25,1,1)是典型 8 步采样调度的良好起点。对于更长的序列,相应调整模式。 - 此节点不改变总步数;它只覆盖采样器迭代期间的音频 Latent 行为。
评论
使用 GitHub 登录后即可参与讨论。