MiniMax H3 Turbo Ref2V v0.1:支持 ComfyUI 的 4 步参考生视频 LoRA

ComfyUI Wikinews

Lightx2v 与 ModelTC 发布 MiniMax H3 Turbo Ref2V v0.1,这是一款 4 步参考生视频 LoRA,提供开箱即用的 ComfyUI bf16 权重,支持多参考图像视频生成。

8 月 13 日Lightx2v 团队与 ModelTC 发布了 Ref2V Turbo v0.1,这是其 MiniMax H3 Turbo LoRA 系列的参考生视频版本。继 8 月 11 日发布的 FL2V Turbo v1.0 之后,新 checkpoint 将同样的 4 步蒸馏能力带给了 Ref2VA(参考生视频 + 音频),让视频可以由一张或多张参考图像驱动,而不再局限于单一首帧。

来自 Lightx2v Ref2V 测试资产的角色参考图

来自 Lightx2v Ref2V 测试资产的角色参考图

v0.1 版本内容

模型任务训练分辨率训练偏移(视频 / 音频)蒸馏步数(NFE)推荐推理步数
Ref2VA Turbo 4-step v0.1Ref2VA544p(混合宽高比)12 / 344

v0.1 版本在 Hugging Face 上包含两个文件:

  • minimax_h3_ref2v_turbo_4step_v0.1_bf16.safetensors:用于 Diffusers
  • minimax_h3_ref2v_turbo_4step_v0.1_comfyui_bf16.safetensors:可直接放入 ComfyUI 使用,无需转换

在参考图像缩放策略方面,项目推荐使用蒸馏训练中采用的 match 模式:该模式会将参考图像的像素面积与目标画布进行匹配,同时保持其宽高比,并且绝不会放大较小的参考图像。项目支持的所有三种策略都会保持参考图像的宽高比,并使用 H3 分辨率网格(尺寸按 32 的倍数取整),且不会裁剪参考内容。

ComfyUI 用法

MiniMax H3 原生支持 ComfyUI,因此使用该 LoRA 无需任何自定义节点:

  1. minimax_h3_ref2v_turbo_4step_v0.1_comfyui_bf16.safetensors 下载到 ComfyUI/models/loras/ 目录。
  2. 在 Ref2V 工作流中加载基础 MiniMax H3 checkpoint,并在模型加载器与采样器之间应用该 LoRA。
  3. 通过参考输入分支连接一张或多张参考图像,然后运行 4 步采样。

官方 MiniMax H3 R2V 工作流模板 是一个不错的起点。项目还附带了一个专用的示例节点图:video_minimax_h3_ref2v_lightx2v_turbo.json,默认使用 Ref2VA Turbo 4 步 v0.1 checkpoint,分辨率为 960x544(16:9,0.5 MP)。

获取方式

评论

使用 GitHub 登录后即可参与讨论。

评论加载中…
MiniMax H3 Turbo Ref2V v0.1:支持 ComfyUI 的 4 步参考生视频 LoRA | ComfyUI Wiki