MiniMax H3 FL2V Turbo 4-Step v1.2 LoRA: Чистое Аудио
Скачать minimax_h3_fl2v_turbo_4step_v1.2_768p_comfyui_bf16.safetensors: Обновление MiniMax H3 Turbo от LightX2V за 4 шага с более чистой и стабильной генерацией Аудио.
Команда LightX2V выпустила FL2V Turbo 4-step v1.2 768p, новейшую запись в линии дистилляции Minimax-h3-Turbo. v1.2 сохраняет ту же быструю настройку генерации за 4 шага, что и v1.1, и полностью сосредоточена на одной слабости: качестве Аудио. Сравнение релиза показывает более чистый и стабильный сгенерированный Аудио с меньшим количеством артефактов при идентичных настройках (обсуждение релиза).
Что изменилось в v1.2
v1.2 является обновлением качества Аудио для FL2V (первый/последний кадр) 4-шагового 768p LoRA, а не новой Архитектурой:
- Более чистое и стабильное Аудио с меньшим количеством артефактов
- Та же настройка генерации за 4 шага (NFE 4), что и v1.1
- Веса diffusers и ComfyUI bf16 опубликованы рядом
| Файл | Формат |
|---|---|
minimax_h3_fl2v_turbo_4step_v1.2_768p_bf16.safetensors | diffusers |
minimax_h3_fl2v_turbo_4step_v1.2_768p_comfyui_bf16.safetensors | ComfyUI, no conversion needed |
Сравнение v1.1 и v1.2 (включить Аудио)
Команда поделилась сравнениями бок о бок, используя те же Входные данные, промпт, сид и настройки Вывода:
| v1.1 | v1.2 |
|---|---|
Рекомендуемые настройки
| Настройка | Значение |
|---|---|
| Шаги | 4 |
| Сдвиг Видео | 6 |
| Сдвиг Аудио | 3 |
| СЭМПЛЕР | Euler |
| Разрешение | До 768p |
Сдвиги Видео и Аудио устанавливаются через ноду ModelSamplingMiniMaxH3, прикреплённую ПОСЛЕ загрузки модели диффузии. Обратите внимание, что некоторые ранние тестеры в потоке обсуждений Hugging Face считали, что визуальное качество пострадало по сравнению с v1.1, поэтому если качество Видео важнее Аудио в вашем конвейере, сохранение v1.1 является разумным выбором.
Использование в ComfyUI
MiniMax H3 имеет нативную поддержку ComfyUI, поэтому Пользовательская Нода не обязательна для LoRA:
- Скачайте
minimax_h3_fl2v_turbo_4step_v1.2_768p_comfyui_bf16.safetensorsвComfyUI/models/loras/. - Загрузите базовый чекпоинт MiniMax H3 и Примените LoRA между загрузчиком модели и СЭМПЛЕРом.
- Установите 4 шага Выборки, СЭМПЛЕР Euler, сдвиг Видео 6 и сдвиг Аудио 3 через
ModelSamplingMiniMaxH3, затем Генерировать до 768p.
Собственные примерные графики проекта в ModelTC/Minimax-H3-Turbo также актуальны; графики T2VA/I2VA являются ближайшим совпадением для пути FL2V.
Доступность
- Веса: lightx2v/Minimax-h3-Turbo на Hugging Face (Apache-2.0), форматы bf16 diffusers и ComfyUI
- Код и Рабочие процессы: ModelTC/Minimax-H3-Turbo на GitHub
- Хостинг: LightX2V Studio запускает линию Turbo в облаке
Комментарии
Войдите через GitHub, чтобы участвовать в обсуждении.