MiniMax H3 Turbo LoRA v1.0:8 步与 768p FL2V 权重
ComfyUI Wikinews
Lightx2v 和 ModelTC 发布 MiniMax H3 Turbo LoRA v1.0,包含 8 步 FL2V checkpoint 和 4 步 768p 变体,两者均提供 ComfyUI 可直接使用的 bf16 权重。
8 月 11 日,Lightx2v 团队和 ModelTC 发布了 MiniMax H3 Turbo LoRA 的 v1.0 版本,该版本紧随 8 月 7 日的 v0.1 预览 发布。此次更新新增了两个 bf16 格式的 FL2VA checkpoint,每个都附带 ComfyUI 可直接使用的格式,其中包括一个以更高分辨率训练的变体。
来自 Lightx2v Turbo LoRA 项目演示输出的示例帧
v1.0 新增内容
| 模型 | 使用例 | 训练分辨率 | 蒸馏步数 | 推荐推理步数 |
|---|---|---|---|---|
| FL2VA Turbo 4 步 v0.1 | FL2VA / T2VA | 544p(混合宽高比) | 4 | 4 |
| FL2VA Turbo 8 步 v1.0 | FL2VA / T2VA | 544p(混合宽高比) | 8 | 8 或 4 |
| FL2VA Turbo 4 步 v1.0 768p | FL2VA / T2VA | 768p(1344x768) | 4 | 4 |
v1.0 版本在 Hugging Face 上提供了两个新的 checkpoint:
- 8 步 v1.0(
minimax_h3_fl2v_turbo_8step_v1.0_bf16.safetensors):以 8 NFE 蒸馏,视频/音频 shift 为 12/3,可在 8 步或 4 步推理下使用。 - 4 步 v1.0 768p(
minimax_h3_fl2v_turbo_4step_v1.0_768p_bf16.safetensors):在 768p(1344x768)分辨率下训练的 4 步蒸馏版本,采用 6/3 shift,面向更高分辨率的首帧/末帧到视频生成。
每个 checkpoint 都有对应的 ComfyUI 格式版本(..._comfyui_bf16.safetensors),存放在同一仓库中,因此无需单独转换。
ComfyUI 用法
MiniMax H3 原生支持 ComfyUI,因此使用该 LoRA 无需自定义节点:
- 下载 ComfyUI 格式的文件(例如
minimax_h3_fl2v_turbo_8step_v1.0_comfyui_bf16.safetensors),放入ComfyUI/models/loras/目录。 - 在 FL2VA 工作流中加载基础 MiniMax H3 checkpoint,并在模型加载器和采样器之间应用 LoRA。
- 对于 8 步 checkpoint,运行 8 步采样(4 步也可用);对于 768p 变体,在 768p 分辨率下运行 4 步。
官方的 MiniMax H3 图生视频工作流模板 是一个很好的起点:在模型加载器和采样器之间插入 Turbo LoRA,然后切换到上述步数设置。
获取方式
- 权重:lightx2v/Minimax-h3-Turbo(Hugging Face,提供 bf16 diffusers 和 ComfyUI 格式)
- 代码:ModelTC/Minimax-H3-Turbo(GitHub),包含批处理推理脚本以及 NFE/LoRA 对比
评论
使用 GitHub 登录后即可参与讨论。