MiniMax H3 Turbo Ref2VA 8-шагов v1.0: LoRA для видео по референсу

ComfyUI Wikinews

Скачать minimax_h3_ref2v_turbo_8step_v1.0_comfyui_bf16.safetensors: дистилляция Ref2VA 8 шагов 768p от Lightx2v для MiniMax H3, с аудио и примерами.

Команда Lightx2v и ModelTC обновили Minimax-h3-Turbo версией Ref2VA Turbo 8-step v1.0 768p, дистилляцией пути «референс-в-видео» на 8 шагов и 768p: одно или несколько опорных изображений управляют сгенерированным видео с аудио при доли шагов базовой модели (репозиторий релиза).

Это закрывает последнюю брешь в линейке Turbo. Со стороны FL2VA уже были 8-шаговые и 768p чекпойнты с момента выпуска v1.0, тогда как Ref2VA имел только версию 4-step v0.1 при 544p.

Характеристики модели

В таблице спецификаций модели теперь перечислены шесть чекпойнтов для FL2VA и Ref2VA. Новая запись:

МодельЗадачиРазрешение обученияСдвиги обучения (видео / аудио)Шаги дистилляции (NFE)РЕКОМЕНДУЕТСЯ шаги вывода
Ref2VA Turbo 8-step v1.0 768pRef2VA768p (1344x768)6 / 388

Два файла поставляются для него на Hugging Face:

  • minimax_h3_ref2v_turbo_8step_v1.0_768p_bf16.safetensors для Diffusers
  • minimax_h3_ref2v_turbo_8step_v1.0_768p_comfyui_bf16.safetensors готов для ComfyUI, конвертация не требуется
Студия LightX2V запускает LoRA MiniMax H3 Turbo

Студия LightX2V Studio сейчас предоставляет LoRA FL2VA Turbo 8-step v1.0 768p; тот же репозиторий теперь охватывает путь Ref2VA на 8 шагах и 768p.

Использование в ComfyUI

MiniMax H3 имеет нативную поддержку ComfyUI, поэтому для LoRA не требуется пользовательская нода:

  1. Скачайте minimax_h3_ref2v_turbo_8step_v1.0_768p_comfyui_bf16.safetensors в ComfyUI/models/loras/.
  2. Загрузите базовый чекпойнт MiniMax H3 в рабочем процессе Ref2V и примените LoRA между загрузчиком модели и sampler.
  3. Подключите одно или несколько опорных изображений через ветку ввода референса и запустите 8 шагов выборки при 768p (например, 1344x768).

Официальный шаблон рабочего процесса MiniMax H3 R2V является хорошей отправной точкой. Примерные графы самого проекта также актуальны: video_minimax_h3_ref2v_lightx2v_turbo.json использует по умолчанию чекпойнт Ref2VA Turbo 4-step v0.1, а графы T2VA/I2VA используют по умолчанию FL2VA Turbo 8-step v1.0.

Для изменения размера опорного изображения проект рекомендует режим match, используемый во время обучения дистилляции, доступный через --reference-resize-mode в точке входа вывода.

Доступность

Комментарии

Войдите через GitHub, чтобы участвовать в обсуждении.

Загрузка комментариев…
MiniMax H3 Turbo Ref2VA 8-шагов v1.0: LoRA для видео по референсу | ComfyUI Wiki