MiniMax H3 VFX Edit LoRA 带来提示词驱动的视频编辑

ComfyUI Wikinews

Alissonerdx 的 MiniMax H3 LoRA 包新增提示词驱动的 VFX Edit,并附带文档化的 Style Transfer 与 Head Swap 适配器,含 ComfyUI 工作流与示例片段。

Alissonerdx 的 MiniMax H3 LoRA 包Hugging Face | 文档 | 工作流)已从单个锐度适配器成长为面向 MiniMax H3 的、带完整文档的视频编辑套件。新发布的 VFX Edit LoRA 可对现有视频片段应用指定的修改,并保持其余部分不变;此外还有 Style Transfer 和实验性的 Head Swap,三者均配有逐模型指南、ComfyUI 工作流和示例片段。

该仓库正是九月更早报道的 H3 锐度 LoRA 背后的同一个仓库,也是使用量较高的 H3 LoRA 包之一,撰写本文时约有 239 个点赞和 26,600 次下载。所有模型都基于 H3 的 ref2va 权重训练,并共享同一套条件技巧:来源片段通过核心 MiniMaxH3AddGuide 节点在 frame_idx = 0 处作为对齐引导注入,因此模型看到的是逐帧对齐的原始素材,而不是松散的视频引用。

该包含有哪些内容

模型功能触发词工作流
minimax_h3_vfx_edit_v1.0_r128对已对齐的来源片段进行提示词驱动的 VFX 编辑vfx_edit:minimax_h3_vfxedit_wokflow.json
minimax_h3_vfx_edit_v1.0_r128_ffp更高分辨率的 VFX Edit,带实验性首帧传播vfx_edit:同一工作流
minimax_h3_style_transfer_v1.0_r64依据图像或文本描述为整个片段重新设定风格style_transfer:minimax_h3_style_transfer_workflow.json
minimax_h3_head_swap_v1.0_r32在已对齐片段上进行实验性头部替换head_swap:minimax_h3_head_swap_workflow.json
minimax_h3_lms_v1.0_r64锐度与细节恢复(最初的适配器)固定提示词minimax_h3_lms_workflow.json

除 LoRA 之外,还附带一个独立的 Latent 放大器实验,VFX Edit 权重于 2026 年 9 月 21 日上传。

VFX Edit

VFX Edit 是本次的重点新增功能:给它一个片段外加一句指令,它就会返回同一素材,且仅应用该修改。

vfx_edit: Add fire effects to the man's hands while preserving his identity, pose, motion, clothing, framing, lighting and background.

文档推荐的写法是:先说明要做的编辑,再列出必须保持不变的内容,并且绝不要要求模型保留本就应由它替换的那块区域。已发布两个版本:

  • 标准版r128)在 384 分辨率 Bucket 上以 73 帧片段训练,无需图像引用。
  • FFPr128_ffp,首帧传播)在 512 Bucket 上以 124 帧片段继续该训练,并新增实验性支持:将编辑后的首帧通过 H3 原生图像引用通道推送。如果提供了图像,提示词必须明确写出 <Picture 1> 并说明其角色;如果没有提供,提示词则完全不能提及 <Picture 1><Subject 1>

运行方式:将完整来源片段放入 MiniMaxH3AddGuide,而不是视频引用槽位;匹配来源比例和受支持的帧数,并从 LoRA 强度 1.0 开始。官方公布的局限性坦率说明了它做不到什么:身份漂移、文字与徽标被改写、精细细节偏弱,以及长片段效果更差。它不是合成器,也不保证像素级完全保留。

VFX Edit 示例,来源与结果VFX Edit 示例 2
来自仓库的 VFX Edit 示例片段第二个 VFX Edit 示例

Style Transfer 与 Head Swap

Style Transfer 会为整个片段重新设定风格,同时尽量保持运动、构图和时序不变。来源视频放入 MiniMaxH3AddGuide,风格图像作为 <Picture 1> 放入原生引用通道,强度为 1.0;如果风格开始压过原始运动,可降到约 0.7。对于基础模型本就熟悉的外观,仅用文本风格提示词也有效。文档提醒不要在用参考图像的同时提及某位艺术家,因为文本可能会盖过图像。

Head Swap 标记为实验性,它同时使用两条条件路径且角色不同:用于替换的脸部通过原生引用通道作为 <Picture 1> / <Subject 1> 传入,而完整的基础视频则以 <Video 1> 通过 MiniMaxH3AddGuideframe_idx = 0 处传入。基础视频不得经由原生视频引用通道传递。文档还附有明确的责任使用声明:仅限研究与创作用途,不得用于冒充、欺诈或欺骗。

Style Transfer 示例

来自仓库的 Style Transfer 示例

Latent 放大器实验

该包还记录了一个实验性的 Latent 放大器 checkpoint h3_upscaler_lms_v0.1,它从 LBH-123-AI latent upscaler 起步,并在与 LMS LoRA 相同的锐度数据集上微调了 2,000 步。同样的权重发布了两份,分别位于 latent_upscaler/experiments/ 下,指南中明确说明目前还没有为它上传专门的示例视频或工作流。

获取方式

仓库下载这些 LoRA,放入 ComfyUI/models/loras/,然后从 workflows/ 文件夹加载匹配的工作流:每个工作流都会列出它所需的模型。LoRA 的条件路径本身基于核心 MiniMax H3 节点(包括 MiniMaxH3AddGuide)运行,但随附的示例工作流还会通过第三方节点包来加载视频、缩放帧尺寸并运行潜空间放大器,请按各工作流自带的说明补齐缺失节点。

评论

使用 GitHub 登录后即可参与讨论。

评论加载中…
MiniMax H3 VFX Edit LoRA 带来提示词驱动的视频编辑 | ComfyUI Wiki