ComfyUI H3 Motion Context Auto-Chain:一次运行生成超长对口型视频

ComfyUI Wikinews

ComfyUI-H3-Motion-Context 的扩展插件,自动串联 MiniMax H3 对口型片段:拆分音频,通过 latent 上下文延续动作与音频,最后拼接为一个 MP4。

ComfyUI H3 Motion Context Auto-ChainGitHub)是 ComfyUI-H3-Motion-Context 节点的扩展插件,将标准 MiniMax H3 工作流变成自动化的长视频流水线。它把长音频切分为连续片段,通过 H3 latent 上下文逐片段续接并配合各自的提示词,复用上一片段最后一帧作为参考,最后把所有片段拼接成一个 MP4。
MiniMax H3 对口型自动串联示例画面

作者发布的自动串联对口型演示中的示例画面。

解决的问题

MiniMax H3 单次生成大约只有 20 秒,因此超过这个长度的对口型视频通常需要手动串联 ComfyUI 运行:每 20 秒启动一次新生成、为适配显存调整尺寸、最后再手动拼接。Auto-Chain 插件把这一循环自动化。它把完整音频切成片段大小,保留原始时间轴以实现无缝拼接,自动排队下一个片段,并通过 H3 的 latent 上下文延续视频与音频,让每个片段都从上一个片段继续。

作者的演示(YouTube 上的 TBG ETUR)展示了由串联片段组成的长对口型视频,包括由逐片段提示词驱动的镜头运动:

MiniMax H3 自动串联对口型演示视频

包含的节点

节点作用
H3 Auto Chain Audio将音频切成片段,输出当前片段的音频、提示词、片段编号和链配置
H3 Auto Chain Load Latent为 Motion Context 节点加载上一片段的 H3 视频/音频 latent
H3 Auto Chain Save Latent将当前采样器输出保存到编号槽位,供后续续接
H3 Auto Chain Frame Reference提供参考图像:每个片段都用初始图(last_frame 模式,推荐使用上一片段最后一帧),或仅第一个片段使用
H3 Auto Chain Motion Context续接片段时委托给原始 Motion Context 节点,首个片段直通
H3 Auto Chain + Stitch保存当前片段、提取最后一帧、排队下一片段,链结束时把所有片段拼接为一个 MP4

逐片段提示词使用共享的 style_prompt 加编号 clip_prompts[1] The character walks through a rainy city street.[2] The character enters a warm cafe.……),每个片段都有独立输出文件,因此可以用相同的 chain_id 恢复链或单独重渲染某个片段。

示例工作流

仓库附带一个完整的对口型工作流,将插件节点与原始 H3 Motion Context 包连接起来:

推荐起始设置:20 秒片段、24 fps、22 个上下文帧、last_frame 参考模式。

安装

插件需要原始的 ComfyUI-H3-Motion-Context 包和一个可用的 MiniMax H3 视频工作流。将两个文件夹放入 ComfyUI/custom_nodes/ 并重启 ComfyUI:

ComfyUI/custom_nodes/ComfyUI-H3-Motion-Context-orig/
ComfyUI/custom_nodes/ComfyUI-H3-Motion-Context-Auto-Chain-addon/

实验性的修改版 H3 分支不应与原始包及本插件同时安装,因为它会注册重复的节点 ID。

获取方式

评论

使用 GitHub 登录后即可参与讨论。

评论加载中…
ComfyUI H3 Motion Context Auto-Chain:一次运行生成超长对口型视频 | ComfyUI Wiki