MiniMax H3 Turbo Ref2V v0.1:支持 ComfyUI 的 4 步参考生视频 LoRA
ComfyUI Wikinews
Lightx2v 与 ModelTC 发布 MiniMax H3 Turbo Ref2V v0.1,这是一款 4 步参考生视频 LoRA,提供开箱即用的 ComfyUI bf16 权重,支持多参考图像视频生成。
8 月 13 日,Lightx2v 团队与 ModelTC 发布了 Ref2V Turbo v0.1,这是其 MiniMax H3 Turbo LoRA 系列的参考生视频版本。继 8 月 11 日发布的 FL2V Turbo v1.0 之后,新 checkpoint 将同样的 4 步蒸馏能力带给了 Ref2VA(参考生视频 + 音频),让视频可以由一张或多张参考图像驱动,而不再局限于单一首帧。
来自 Lightx2v Ref2V 测试资产的角色参考图
v0.1 版本内容
| 模型 | 任务 | 训练分辨率 | 训练偏移(视频 / 音频) | 蒸馏步数(NFE) | 推荐推理步数 |
|---|---|---|---|---|---|
| Ref2VA Turbo 4-step v0.1 | Ref2VA | 544p(混合宽高比) | 12 / 3 | 4 | 4 |
v0.1 版本在 Hugging Face 上包含两个文件:
minimax_h3_ref2v_turbo_4step_v0.1_bf16.safetensors:用于 Diffusersminimax_h3_ref2v_turbo_4step_v0.1_comfyui_bf16.safetensors:可直接放入 ComfyUI 使用,无需转换
在参考图像缩放策略方面,项目推荐使用蒸馏训练中采用的 match 模式:该模式会将参考图像的像素面积与目标画布进行匹配,同时保持其宽高比,并且绝不会放大较小的参考图像。项目支持的所有三种策略都会保持参考图像的宽高比,并使用 H3 分辨率网格(尺寸按 32 的倍数取整),且不会裁剪参考内容。
ComfyUI 用法
MiniMax H3 原生支持 ComfyUI,因此使用该 LoRA 无需任何自定义节点:
- 将
minimax_h3_ref2v_turbo_4step_v0.1_comfyui_bf16.safetensors下载到ComfyUI/models/loras/目录。 - 在 Ref2V 工作流中加载基础 MiniMax H3 checkpoint,并在模型加载器与采样器之间应用该 LoRA。
- 通过参考输入分支连接一张或多张参考图像,然后运行 4 步采样。
官方 MiniMax H3 R2V 工作流模板 是一个不错的起点。项目还附带了一个专用的示例节点图:video_minimax_h3_ref2v_lightx2v_turbo.json,默认使用 Ref2VA Turbo 4 步 v0.1 checkpoint,分辨率为 960x544(16:9,0.5 MP)。
获取方式
- 权重:lightx2v/Minimax-h3-Turbo(Hugging Face,bf16 Diffusers 与 ComfyUI 格式)
- 代码与工作流:ModelTC/Minimax-H3-Turbo(GitHub)
- 官方 ComfyUI 模板:video_minimax_h3_r2v(位于 Comfy-Org/workflow_templates)
评论
使用 GitHub 登录后即可参与讨论。