ComfyUI H3 Motion Context Auto-Chain:一次运行生成超长对口型视频
ComfyUI-H3-Motion-Context 的扩展插件,自动串联 MiniMax H3 对口型片段:拆分音频,通过 latent 上下文延续动作与音频,最后拼接为一个 MP4。
作者发布的自动串联对口型演示中的示例画面。
解决的问题
MiniMax H3 单次生成大约只有 20 秒,因此超过这个长度的对口型视频通常需要手动串联 ComfyUI 运行:每 20 秒启动一次新生成、为适配显存调整尺寸、最后再手动拼接。Auto-Chain 插件把这一循环自动化。它把完整音频切成片段大小,保留原始时间轴以实现无缝拼接,自动排队下一个片段,并通过 H3 的 latent 上下文延续视频与音频,让每个片段都从上一个片段继续。
作者的演示(YouTube 上的 TBG ETUR)展示了由串联片段组成的长对口型视频,包括由逐片段提示词驱动的镜头运动:
包含的节点
| 节点 | 作用 |
|---|---|
| H3 Auto Chain Audio | 将音频切成片段,输出当前片段的音频、提示词、片段编号和链配置 |
| H3 Auto Chain Load Latent | 为 Motion Context 节点加载上一片段的 H3 视频/音频 latent |
| H3 Auto Chain Save Latent | 将当前采样器输出保存到编号槽位,供后续续接 |
| H3 Auto Chain Frame Reference | 提供参考图像:每个片段都用初始图(last_frame 模式,推荐使用上一片段最后一帧),或仅第一个片段使用 |
| H3 Auto Chain Motion Context | 续接片段时委托给原始 Motion Context 节点,首个片段直通 |
| H3 Auto Chain + Stitch | 保存当前片段、提取最后一帧、排队下一片段,链结束时把所有片段拼接为一个 MP4 |
逐片段提示词使用共享的 style_prompt 加编号 clip_prompts([1] The character walks through a rainy city street.、[2] The character enters a warm cafe.……),每个片段都有独立输出文件,因此可以用相同的 chain_id 恢复链或单独重渲染某个片段。
示例工作流
仓库附带一个完整的对口型工作流,将插件节点与原始 H3 Motion Context 包连接起来:
推荐起始设置:20 秒片段、24 fps、22 个上下文帧、last_frame 参考模式。
安装
插件需要原始的 ComfyUI-H3-Motion-Context 包和一个可用的 MiniMax H3 视频工作流。将两个文件夹放入 ComfyUI/custom_nodes/ 并重启 ComfyUI:
ComfyUI/custom_nodes/ComfyUI-H3-Motion-Context-orig/
ComfyUI/custom_nodes/ComfyUI-H3-Motion-Context-Auto-Chain-addon/实验性的修改版 H3 分支不应与原始包及本插件同时安装,因为它会注册重复的节点 ID。
获取方式
- 代码:Ltamann/ComfyUI-H3-Motion-Context-Auto-Chain-addon(GitHub)
- 工作流:
example_workflows/中的MiniMax H3 Lipsync.json - 演示:TBG ETUR(YouTube)
评论
使用 GitHub 登录后即可参与讨论。