MiniMax H3 Turbo Ref2VA 8-шагов v1.0: LoRA для видео по референсу
Скачать minimax_h3_ref2v_turbo_8step_v1.0_comfyui_bf16.safetensors: дистилляция Ref2VA 8 шагов 768p от Lightx2v для MiniMax H3, с аудио и примерами.
Команда Lightx2v и ModelTC обновили Minimax-h3-Turbo версией Ref2VA Turbo 8-step v1.0 768p, дистилляцией пути «референс-в-видео» на 8 шагов и 768p: одно или несколько опорных изображений управляют сгенерированным видео с аудио при доли шагов базовой модели (репозиторий релиза).
Это закрывает последнюю брешь в линейке Turbo. Со стороны FL2VA уже были 8-шаговые и 768p чекпойнты с момента выпуска v1.0, тогда как Ref2VA имел только версию 4-step v0.1 при 544p.
Характеристики модели
В таблице спецификаций модели теперь перечислены шесть чекпойнтов для FL2VA и Ref2VA. Новая запись:
| Модель | Задачи | Разрешение обучения | Сдвиги обучения (видео / аудио) | Шаги дистилляции (NFE) | РЕКОМЕНДУЕТСЯ шаги вывода |
|---|---|---|---|---|---|
| Ref2VA Turbo 8-step v1.0 768p | Ref2VA | 768p (1344x768) | 6 / 3 | 8 | 8 |
Два файла поставляются для него на Hugging Face:
minimax_h3_ref2v_turbo_8step_v1.0_768p_bf16.safetensorsдля Diffusersminimax_h3_ref2v_turbo_8step_v1.0_768p_comfyui_bf16.safetensorsготов для ComfyUI, конвертация не требуется
Студия LightX2V Studio сейчас предоставляет LoRA FL2VA Turbo 8-step v1.0 768p; тот же репозиторий теперь охватывает путь Ref2VA на 8 шагах и 768p.
Использование в ComfyUI
MiniMax H3 имеет нативную поддержку ComfyUI, поэтому для LoRA не требуется пользовательская нода:
- Скачайте
minimax_h3_ref2v_turbo_8step_v1.0_768p_comfyui_bf16.safetensorsвComfyUI/models/loras/. - Загрузите базовый чекпойнт MiniMax H3 в рабочем процессе Ref2V и примените LoRA между загрузчиком модели и sampler.
- Подключите одно или несколько опорных изображений через ветку ввода референса и запустите 8 шагов выборки при 768p (например, 1344x768).
Официальный шаблон рабочего процесса MiniMax H3 R2V является хорошей отправной точкой. Примерные графы самого проекта также актуальны: video_minimax_h3_ref2v_lightx2v_turbo.json использует по умолчанию чекпойнт Ref2VA Turbo 4-step v0.1, а графы T2VA/I2VA используют по умолчанию FL2VA Turbo 8-step v1.0.
Для изменения размера опорного изображения проект рекомендует режим match, используемый во время обучения дистилляции, доступный через --reference-resize-mode в точке входа вывода.
Доступность
- Веса: lightx2v/Minimax-h3-Turbo на Hugging Face (Apache-2.0), форматы bf16 для Diffusers и ComfyUI
- Код и рабочие процессы: ModelTC/Minimax-H3-Turbo на GitHub
- Хостинг: LightX2V Studio и LightX2V API запускают линейку Turbo в облаке
Комментарии
Войдите через GitHub, чтобы участвовать в обсуждении.