MiniMax H3 Turbo LoRA v1.0: веса FL2V для 8 шагов и 768p
Lightx2v и ModelTC выпускают MiniMax H3 Turbo LoRA v1.0 с чекпойнтом FL2V для 8 шагов и вариантом 768p для 4 шагов, оба с весами bf16, готовыми для ComfyUI.
11 августа команда Lightx2v и ModelTC выпустили v1.0 своей MiniMax H3 Turbo LoRA, после раннего предпросмотра v0.1 от 7 августа. Обновление добавляет два новых чекпойнта FL2VA в bf16, каждый из которых поставляется в формате, готовом для ComfyUI, включая вариант, обученный на более высоком разрешении.
Пример кадра из демонстрационного вывода проекта Lightx2v Turbo LoRA
Что входит в v1.0
| Модель | Задачи | Разрешение обучения | Шаги дистилляции | Рекомендуемые шаги вывода |
|---|---|---|---|---|
| FL2VA Turbo 4-шаговый v0.1 | FL2VA / T2VA | 544p (смешанные соотношения сторон) | 4 | 4 |
| FL2VA Turbo 8-шаговый v1.0 | FL2VA / T2VA | 544p (смешанные соотношения сторон) | 8 | 8 или 4 |
| FL2VA Turbo 4-шаговый v1.0 768p | FL2VA / T2VA | 768p (1344x768) | 4 | 4 |
Релиз v1.0 включает два новых чекпойнта на Hugging Face:
- 8-шаговый v1.0 (
minimax_h3_fl2v_turbo_8step_v1.0_bf16.safetensors): дистиллирован при 8 NFE со сдвигами видео/аудио 12/3 и может использоваться на 8 или 4 шагах вывода. - 4-шаговый v1.0 768p (
minimax_h3_fl2v_turbo_4step_v1.0_768p_bf16.safetensors): 4-шаговая дистилляция, обученная на разрешении 768p (1344x768) со сдвигами 6/3, нацелена на генерацию видео по первому/последнему кадру на более высоком разрешении.
Каждый чекпойнт поставляется также в формате ComfyUI (..._comfyui_bf16.safetensors) в том же репозитории, поэтому отдельная конвертация не требуется.
Использование в ComfyUI
MiniMax H3 имеет встроенную поддержку ComfyUI, поэтому для LoRA не требуется пользовательских нод:
- Скачайте файл в формате ComfyUI (например,
minimax_h3_fl2v_turbo_8step_v1.0_comfyui_bf16.safetensors) в папкуComfyUI/models/loras/. - Загрузите базовый чекпойнт MiniMax H3 в рабочий процесс FL2VA и примените LoRA между загрузчиком модели и сэмплером.
- Для 8-шагового чекпойнта выполните 8 шагов выборки (подойдут и 4); для варианта 768p выполните 4 шага на разрешении 768p.
Официальный шаблон рабочего процесса MiniMax H3 для генерации видео из изображения послужит хорошей отправной точкой: вставьте Turbo LoRA между загрузчиком модели и сэмплером и переключитесь на настройки шагов, указанные выше.
Доступность
- Веса: lightx2v/Minimax-h3-Turbo на Hugging Face (форматы bf16 diffusers и ComfyUI)
- Код: ModelTC/Minimax-H3-Turbo на GitHub, включая скрипт пакетного вывода и сравнения NFE/LoRA
Комментарии
Войдите через GitHub, чтобы участвовать в обсуждении.