MiniMax H3 FL2V Turbo 4-Step v1.2 LoRA: Чистое Аудио

ComfyUI Wikinews

Скачать minimax_h3_fl2v_turbo_4step_v1.2_768p_comfyui_bf16.safetensors: Обновление MiniMax H3 Turbo от LightX2V за 4 шага с более чистой и стабильной генерацией Аудио.

Команда LightX2V выпустила FL2V Turbo 4-step v1.2 768p, новейшую запись в линии дистилляции Minimax-h3-Turbo. v1.2 сохраняет ту же быструю настройку генерации за 4 шага, что и v1.1, и полностью сосредоточена на одной слабости: качестве Аудио. Сравнение релиза показывает более чистый и стабильный сгенерированный Аудио с меньшим количеством артефактов при идентичных настройках (обсуждение релиза).

MiniMax H3 FL2V Turbo v1.2 example frame

Что изменилось в v1.2

v1.2 является обновлением качества Аудио для FL2V (первый/последний кадр) 4-шагового 768p LoRA, а не новой Архитектурой:

  • Более чистое и стабильное Аудио с меньшим количеством артефактов
  • Та же настройка генерации за 4 шага (NFE 4), что и v1.1
  • Веса diffusers и ComfyUI bf16 опубликованы рядом
ФайлФормат
minimax_h3_fl2v_turbo_4step_v1.2_768p_bf16.safetensorsdiffusers
minimax_h3_fl2v_turbo_4step_v1.2_768p_comfyui_bf16.safetensorsComfyUI, no conversion needed

Сравнение v1.1 и v1.2 (включить Аудио)

Команда поделилась сравнениями бок о бок, используя те же Входные данные, промпт, сид и настройки Вывода:

v1.1v1.2

Рекомендуемые настройки

НастройкаЗначение
Шаги4
Сдвиг Видео6
Сдвиг Аудио3
СЭМПЛЕРEuler
РазрешениеДо 768p

Сдвиги Видео и Аудио устанавливаются через ноду ModelSamplingMiniMaxH3, прикреплённую ПОСЛЕ загрузки модели диффузии. Обратите внимание, что некоторые ранние тестеры в потоке обсуждений Hugging Face считали, что визуальное качество пострадало по сравнению с v1.1, поэтому если качество Видео важнее Аудио в вашем конвейере, сохранение v1.1 является разумным выбором.

Использование в ComfyUI

MiniMax H3 имеет нативную поддержку ComfyUI, поэтому Пользовательская Нода не обязательна для LoRA:

  1. Скачайте minimax_h3_fl2v_turbo_4step_v1.2_768p_comfyui_bf16.safetensors в ComfyUI/models/loras/.
  2. Загрузите базовый чекпоинт MiniMax H3 и Примените LoRA между загрузчиком модели и СЭМПЛЕРом.
  3. Установите 4 шага Выборки, СЭМПЛЕР Euler, сдвиг Видео 6 и сдвиг Аудио 3 через ModelSamplingMiniMaxH3, затем Генерировать до 768p.

Собственные примерные графики проекта в ModelTC/Minimax-H3-Turbo также актуальны; графики T2VA/I2VA являются ближайшим совпадением для пути FL2V.

Доступность

Комментарии

Войдите через GitHub, чтобы участвовать в обсуждении.

Загрузка комментариев…
MiniMax H3 FL2V Turbo 4-Step v1.2 LoRA: Чистое Аудио | ComfyUI Wiki