Anima Control Pose Preview-2: Control de Pose Nativo para ComfyUI
Anima Control Pose Preview-2 trae generación de imágenes controladas por pose a Anima con nodos personalizados nativos de ComfyUI, soporte multiresolución a 512/768/1024 y precisión de pose mejorada
Se ha lanzado un nuevo adaptador de control de pose para el modelo de imagen Anima v1.0 — Anima Control Pose Preview-2 trae condicionamiento de pose basado en esqueleto a Anima con nodos personalizados nativos de ComfyUI, soporte multiresolución y una precisión sustancialmente mejorada en el seguimiento de poses.
Qué Hace
Anima Control Pose es un control-LoRA de concatenación de canales que condiciona la generación de imágenes de Anima a un mapa de pose de esqueleto. Dada una foto de referencia, el nodo de ComfyUI detecta la pose y renderiza un esqueleto, que el modelo sigue durante la generación — permitiendo un control preciso sobre la posición de personajes, gestos y lenguaje corporal en imágenes generadas por IA.
Preview-2 es una actualización importante sobre Preview-1 que incluye:
- Soporte multiresolución: 512, 768 y 1024 px (Preview-1 solo 512)
- Corpus de entrenamiento más grande — anatomía más limpia y poses más estables
- Nuevo nodo de ComfyUI "Anima Pose Control" — detecta automáticamente la pose de una foto de referencia con múltiples estilos de renderizado de esqueleto (fino, grueso, títere, mapa de calor, con/sin manos y rostro)
- Body-PCK@0.1: ~0.83 a resolución 1024 (vs ~0.59 para Preview-1 a 512)
Método
El adaptador de control utiliza un ControlEmbedder inicializado en cero que produce tokens de control añadidos a la salida congelada del patch-embed base, más un adaptador de bajo rango (rank-16) en los bloques del transformer. El modelo base Anima, el codificador de texto y el VAE permanecen congelados.
Con strength = 0, el adaptador es exactamente el modelo base — la contribución del control crece solo a medida que gana pérdida durante el entrenamiento.
| Parámetro | Valor |
|---|---|
| Resolución | 512 + 768 + 1024, con buckets de relación de aspecto |
| Rango del adaptador | 16 |
| Dropout de control | 0.1 |
| Precisión | bf16 |
Disponibilidad
Anima Control Pose Preview-2 está disponible en Hugging Face bajo una licencia no comercial:
- Repositorio HF: Claquasse/Anima-Control-Pose
- Archivo principal:
anima_pose_preview2.safetensors(colocar enComfyUI/models/loras/) - Nodos personalizados: Incluidos en el repositorio bajo
comfyui/ - Modelo base: Anima v1.0 de Circlestone Labs (requerido)
El autor señala que Preview-2 sigue siendo experimental — aunque mejorado significativamente, aún puede fallar en poses complejas o producir artefactos. Se está desarrollando una Preview-3 con enfoque en una mejor representación del esqueleto y un detector de pose específico para anime.
Uso en ComfyUI
Preview-2 utiliza dos pequeños nodos personalizados: Anima Control Apply (AnimaControlApply) aplica el adaptador, y Anima Pose Control (AnimaPoseControl) detecta la pose desde una foto y renderiza el esqueleto.
Instalación
- Descarga
anima_pose_preview2.safetensorsenComfyUI/models/loras/. - Copia ambas carpetas desde
comfyui/en el repositorio de HF haciaComfyUI/custom_nodes/:anima_control_lora/ComfyUI-anima-pose-control/
- Reinicia ComfyUI. ComfyUI-Manager instala automáticamente el
requirements.txtdel segundo nodo; de lo contrario, ejecuta:(rtmlib, opencv-python, onnxruntime, numpy; torch y Pillow vienen con ComfyUI.)pip install -r ComfyUI-anima-pose-control/requirements.txt - Carga un flujo de trabajo desde el menú (ver más abajo).
El archivo safetensors contiene tanto el adaptador de bajo rango (claves lora.*) como el control embedder (claves control_embedder.*). Un LoraLoaderModelOnly lee los pesos LoRA, mientras que Anima Control Apply lee el control embedder — ambos apuntan al mismo archivo.
Flujos de trabajo
Se incluyen cuatro flujos de trabajo .json en el repositorio de HF:
pose_control_demo.json(el más sencillo) — control vs sin control lado a ladopose_control.json— flujo de trabajo simple de generación únicapose_control_edit.json— nodo único con selector de estilo de esqueletopose_control_compare.json— una pose renderizada en todos los estilos de esqueleto a la vez
Intensidad
0.0 produce el modelo base sin control; 1.0 sigue el esqueleto (rango 0–2). Los valores más altos siguen la pose con mayor precisión pero pueden reducir la calidad de la imagen.
Detector de pose (primer uso)
El nodo Anima Pose Control necesita un detector de pose (rtmlib). En el primer uso descarga dos archivos ONNX (~316 MB en total) desde la carpeta detector/ del repositorio de HF y los guarda en caché bajo ~/.cache/rtmlib/hub/checkpoints/; después de eso funciona sin conexión.
Si ves urllib ... getaddrinfo failed, la máquina no pudo alcanzar el servidor de descarga. Descarga manualmente los dos archivos ONNX desde la pestaña Files del repositorio de HF y colócalos en esa carpeta de caché (créala si no existe), luego reinicia ComfyUI:
detector/yolox_m_8xb8-300e_humanart-c2c7a14a.onnxdetector/rtmw-dw-x-l_simcc-cocktail14_270e-256x192_20231122.onnx
Comentarios
Inicia sesión con GitHub para unirte a la conversación.