Wan-Animate-2:ComfyUI 端到端角色动画
ComfyUI Wiki
Wan-Animate-2 借助双分支 DiT、原生 ComfyUI 节点与文本驱动的视角控制,根据引用图像和驱动视频让角色动起来。
W
Wan-Animate-2
视频角色动画开源DiT来自阿里巴巴通义实验室的端到端角色动画模型。将驱动视频直接输入重新设计的双分支 Diffusion Transformer,无需中间的骨骼或表情提取器,并具备文本驱动的视角控制、多角色动作驱动以及实时 Lite 变体。采用 Apache 2.0 许可证。
| 开发者 | 阿里巴巴通义实验室(Wan AI) |
| 发布日期 | 2026-08-07 |
| 架构 | 双分支 Diffusion Transformer:Time-Align RoPE + Sparse-Ref 注意力 |
| 许可证 | Apache-2.0 |
| 模型规模 | 14B(Base 与 Distillation 两个变体) |
| 能力 | 引用图像 + 驱动视频的角色动画、文本驱动的视角控制、一对一及多对多的动作驱动、实时 Lite 流式生成 |
| 采样 | Base:40 步;Distillation:10 步,不使用 CFG(Euler scheduler) |
| ComfyUI 支持 | 原生支持:WanAnimate2ToVideo 与 WanAnimate2Cache 节点(实验性) |
Guides and workflows related to this model series.
No articles found.
评论
使用 GitHub 登录后即可参与讨论。