LanPaint 2.0.0:MiniMax H3 视频与音频修复
LanPaint 2.0.0 新增 MiniMax H3 支持,提供视频与音频修复流水线:在一个编辑器中绘制逐帧遮罩和音频区间,然后一次性完成两者的修复。
LanPaint 于 8 月 9 日发布了 2.0.0 版本,新增了专用的 MiniMax H3 视频与音频修复流水线。LanPaint 是 TMLR 论文 LanPaint: Training-Free Diffusion Inpainting with Asymptotically Exact and Fast Conditional Sampling 中无需训练的修复采样器的 ComfyUI 实现,这一大版本让你能够一次性修复 H3 视频及其配套音频流。
![]() | ![]() | ![]() |
|---|---|---|
| 带遮罩的输入(在编辑器中绘制) | 可见遮罩叠加 | 修复后的视频和音频 |
音视频流水线的工作原理
新流水线支持在同一次编辑器会话中绘制视频遮罩和音频区间,将两条流编码进一个嵌套 Latent,然后仅需运行一次采样器:
- LanPaint_VideoMaskEditor:选择视频,在关键帧上绘制逐帧遮罩(中间帧通过 SDF 插值生成),并在波形上拖拽出音频区间。遮罩为 1 时重新生成,为 0 时保留。
- LanPaint_AVEncode:将视频帧和音轨连同遮罩一起编码进一个嵌套 Latent。
- 采样器:照常运行;音频流按自身偏移的 sigma 调度进行去噪。
- LanPaint_AVDecode:在遮罩混合边界处将修复后的视频与原始视频合并,并在遮罩区间内以短暂交叉淡化合并修复后的音频,同时保留来源的帧率与位深度。
你还可以将遮罩导出到视频文件本身:编辑器中的 Export mask video 按钮会重新封装(remux)一份 <name>_masked.mp4 副本,将遮罩嵌入文件元数据中,这样带遮罩的片段之后可以重新打开或共享,且不会丢失所绘制的遮罩。
如何在 ComfyUI 中使用
将 LanPaint 作为常规自定义节点安装(通过 ComfyUI Manager,或将 git clone https://github.com/scraed/LanPaint 克隆到 ComfyUI/custom_nodes/ 目录),然后下载 MiniMax H3 模型文件并加载官方的音视频修复示例:
该工作流使用 LanPaint Sampler Custom (Advanced) 节点。作为参考,README 的资源表显示,在 480p–880p 分辨率、20 步条件下修复 40–81 帧的视频,大约需要 38–43 GB 显存;因此,24 GB 显存的显卡可以处理较短的片段,而高显存配置则可以处理更长的视频。
获取方式
LanPaint 2.0.0 是一款免费开源的 ComfyUI 扩展(GitHub、ComfyUI Registry)。此次更新还包含对最新版 ComfyUI 的兼容性修复。除 MiniMax H3 外,该采样器继续支持 SDXL、Flux、Hunyuan、Qwen-Image、Krea 2、Z-Image、Ideogram 4 和 Wan 2.2 的修复工作流。



评论
使用 GitHub 登录后即可参与讨论。