Описание
Нода LTX2 Audio Latent Normalizing Sampling улучшает качество аудио, сгенерированного LTX2, применяя пошаговую нормализацию к аудио латентам во время процесса выборки. Это может помочь уменьшить артефакты и улучшить согласованность, особенно для более длинных аудио.
Входы
-
model (
MODEL, обязательно)
Модель LTX2, к которой будет добавлено переопределение нормализации аудио. -
audio_normalization_factors (
STRING, обязательно, по умолчанию:"1,1,0.25,1,1,0.25,1,1")
Список разделённых запятыми коэффициентов нормализации, по одному на шаг выборки. Каждый коэффициент масштабирует аудио латент на этом шаге.
Например, значение по умолчанию"1,1,0.25,1,1,0.25,1,1"применяет коэффициент0.25на шагах 3 и 6 (считая с 1), ослабляя латент на этих шагах.
Коэффициенты могут быть любыми положительными числами с плавающей запятой; значения меньше 1 уменьшают величину латента, значения больше 1 усиливают его.
Длина списка должна соответствовать общему количеству шагов выборки, используемых в конвейере генерации. Если он длиннее, лишние значения игнорируются; если короче, последнее значение повторяется для оставшихся шагов.
Выходы
MODEL
Возвращает изменённую модель с прикреплённым поведением нормализации. Передайте эту модель в стандартный рабочий процесс выборки; коэффициенты нормализации будут применяться автоматически на каждом шаге выборки.
Примечания по использованию
- Эта нода предназначена для использования с аудио моделями LTX2 в категории
KJNodes/ltxv. - Коэффициенты нормализации применяются в дополнение к любому масштабированию латентов, уже выполняемому сэмплером. Они действуют как пошаговая регулировка усиления аудио латента.
- Экспериментирование с различными последовательностями коэффициентов может помочь уменьшить высокочастотный шум, стабилизировать громкость или выделить определённые временные области.
- Если вы не уверены, какие коэффициенты использовать, последовательность по умолчанию (
1,1,0.25,1,1,0.25,1,1) является хорошей отправной точкой для типичного расписания из 8 шагов выборки. - Нода не изменяет общее количество шагов; она только переопределяет поведение аудио латента во время итераций сэмплера.
Комментарии
Войдите через GitHub, чтобы участвовать в обсуждении.