Anima Control Pose 预览版2:ComfyUI 原生姿态控制

news

Anima Control Pose 预览版2为Anima带来姿态控制的图像生成,支持原生ComfyUI自定义节点、512/768/1024多分辨率以及改进的姿态准确性

面向Anima v1.0图像模型的姿态控制适配器已发布:Anima Control Pose 预览版2为Anima带来了基于骨架的姿态条件功能,支持原生ComfyUI自定义节点、多分辨率以及大幅提升的姿态跟随准确性。

功能概述

Anima Control Pose是一个通道拼接控制LoRA,通过骨架姿态图对Anima图像生成进行条件控制。给定一张参考照片后,ComfyUI节点检测姿态并渲染出骨架,模型在生成过程中依据该骨架进行绘制,从而实现对AI生成图像中角色位置、手势和肢体语言的精确控制。

预览版2相比预览版1的重大更新包括:

  • 多分辨率支持:512、768和1024像素(预览版1仅支持512)
  • 更大的训练语料库,生成更清晰的解剖结构和更稳定的姿态
  • 新增ComfyUI节点“Anima Pose Control”,可从参考照片自动检测姿态,并支持多种骨架渲染样式(细线、粗线、木偶、热力图、包含/不含手部和面部)
  • Body-PCK@0.1:在1024分辨率下约为0.83(预览版1在512分辨率下约为0.59)

方法

该控制适配器使用零初始化的ControlEmbedder生成控制标记,并将其添加到冻结的基础补丁嵌入输出中,同时在Transformer块上应用秩16的低秩适配器。基础Anima模型、文本编码器和VAE均保持冻结。

strength = 0时,适配器与基础模型完全一致,控制贡献仅在训练过程中获得损失时才逐渐增加。

设置
分辨率512 + 768 + 1024,宽高比分桶
适配器秩16
控制丢弃率0.1
精度bf16

在ComfyUI中的使用

本发布版本包含实现无缝ComfyUI体验所需的一切:

  1. 安装:将anima_pose_preview2.safetensors放入ComfyUI/models/loras/,然后将两个自定义节点文件夹(anima_control_lora/ComfyUI-anima-pose-control/)复制到ComfyUI/custom_nodes/
  2. 工作流:包含四个.json工作流文件(演示:控制与无控制并排对比;简单;编辑;比较:同一姿态使用所有骨架样式)
  3. 姿态检测:Anima Pose Control节点在首次使用时自动下载DWPose ONNX模型(约316 MB),缓存后可离线使用

获取方式

Anima Control Pose 预览版2可在Hugging Face上获取,采用非商业许可证:

  • Hugging Face仓库czxkck/Anima-Control-Pose
  • 主文件anima_pose_preview2.safetensors(放入ComfyUI/models/loras/
  • 自定义节点:位于仓库的comfyui/目录下
  • 基础模型:Circlestone Labs的Anima v1.0(必需)

作者指出,预览版2仍处于实验性阶段。虽然效果已有显著提升,但在复杂姿态上仍可能出现误判或伪影。目前正在开发预览版3,重点关注更好的骨架表示以及专门针对动漫的姿态检测器。

评论

使用 GitHub 登录后即可参与讨论。

评论加载中…
Anima Control Pose 预览版2:ComfyUI 原生姿态控制 | ComfyUI Wiki