Anima Control Pose 预览版2:ComfyUI 原生姿态控制
news
Anima Control Pose 预览版2为Anima带来姿态控制的图像生成,支持原生ComfyUI自定义节点、512/768/1024多分辨率以及改进的姿态准确性
面向Anima v1.0图像模型的姿态控制适配器已发布:Anima Control Pose 预览版2为Anima带来了基于骨架的姿态条件功能,支持原生ComfyUI自定义节点、多分辨率以及大幅提升的姿态跟随准确性。
功能概述
Anima Control Pose是一个通道拼接控制LoRA,通过骨架姿态图对Anima图像生成进行条件控制。给定一张参考照片后,ComfyUI节点检测姿态并渲染出骨架,模型在生成过程中依据该骨架进行绘制,从而实现对AI生成图像中角色位置、手势和肢体语言的精确控制。
预览版2相比预览版1的重大更新包括:
- 多分辨率支持:512、768和1024像素(预览版1仅支持512)
- 更大的训练语料库,生成更清晰的解剖结构和更稳定的姿态
- 新增ComfyUI节点“Anima Pose Control”,可从参考照片自动检测姿态,并支持多种骨架渲染样式(细线、粗线、木偶、热力图、包含/不含手部和面部)
- Body-PCK@0.1:在1024分辨率下约为0.83(预览版1在512分辨率下约为0.59)
方法
该控制适配器使用零初始化的ControlEmbedder生成控制标记,并将其添加到冻结的基础补丁嵌入输出中,同时在Transformer块上应用秩16的低秩适配器。基础Anima模型、文本编码器和VAE均保持冻结。
当strength = 0时,适配器与基础模型完全一致,控制贡献仅在训练过程中获得损失时才逐渐增加。
| 设置 | 值 |
|---|---|
| 分辨率 | 512 + 768 + 1024,宽高比分桶 |
| 适配器秩 | 16 |
| 控制丢弃率 | 0.1 |
| 精度 | bf16 |
在ComfyUI中的使用
本发布版本包含实现无缝ComfyUI体验所需的一切:
- 安装:将
anima_pose_preview2.safetensors放入ComfyUI/models/loras/,然后将两个自定义节点文件夹(anima_control_lora/和ComfyUI-anima-pose-control/)复制到ComfyUI/custom_nodes/ - 工作流:包含四个
.json工作流文件(演示:控制与无控制并排对比;简单;编辑;比较:同一姿态使用所有骨架样式) - 姿态检测:Anima Pose Control节点在首次使用时自动下载DWPose ONNX模型(约316 MB),缓存后可离线使用
获取方式
Anima Control Pose 预览版2可在Hugging Face上获取,采用非商业许可证:
- Hugging Face仓库:czxkck/Anima-Control-Pose
- 主文件:
anima_pose_preview2.safetensors(放入ComfyUI/models/loras/) - 自定义节点:位于仓库的
comfyui/目录下 - 基础模型:Circlestone Labs的Anima v1.0(必需)
作者指出,预览版2仍处于实验性阶段。虽然效果已有显著提升,但在复杂姿态上仍可能出现误判或伪影。目前正在开发预览版3,重点关注更好的骨架表示以及专门针对动漫的姿态检测器。
评论
使用 GitHub 登录后即可参与讨论。