Krea 2 Anygles: LoRA de control de cámara para ComfyUI

ComfyUI Wikinews

Krea 2 Anygles convierte una foto de una persona en una nueva vista de cámara con un LoRA de normal humana 3D, además de nodos de ComfyUI y un flujo de trabajo.

krea2-anygles es un LoRA de control espacial para Krea 2 Turbo que cambia el punto de vista de la cámara de un único sujeto humano manteniendo la persona, la pose, la ropa, el estilo y la escena. Se distribuye con nodos de ComfyUI nativos y un flujo de trabajo listo para usar.

Apunta una cámara a una persona y luego muévela: la órbita horizontal, la elevación y el control de distancia provienen de un solo adaptador. Anygles recupera una malla humana 3D y un mapa de normales alineado a partir de la imagen fuente, gira esa malla a la pose solicitada y alimenta la normal renderizada a Krea 2 como control espacial. La imagen original permanece como referencia de identidad y estilo, de modo que el modelo genera una vista nueva en lugar de editar la anterior.

Imagen fuenteVista de cámara generada
Imagen fuente, un único sujeto humanoEl mismo sujeto desde una posición de cámara rotada

Una órbita horizontal. Cada fotograma se genera de forma independiente a partir de la fuente original, por lo que las vistas no se encadenan entre sí.

Qué controla

  • Órbita horizontal completa: guiñada continua a lo largo de un giro completo de 360 grados.
  • Elevación: mueve el punto de vista por encima o por debajo del sujeto manteniendo proporciones corporales naturales.
  • Distancia: pasa de un encuadre más cercano a vistas más amplias.
  • Movimiento combinado: varía guiñada, elevación y distancia juntas a lo largo de una trayectoria suave.
  • Generación independiente: cada vista parte de la imagen fuente original, lo que evita la deriva que se acumula cuando los fotogramas generados se realimentan en el modelo.
  • Encuadre consciente de la fuente: la salida mantiene la relación de aspecto de la fuente con dimensiones alineadas a 16 píxeles.

Los rangos de control expuestos son elevación de -60 a +60 grados y distancia de 0.6x a 1.8x, descritos por el autor como barreras de la interfaz más que límites estrictos. Los barridos de la versión cubren elevación de -45 a +45 grados y distancia de 1.35x a 0.78x.

Acimut, elevación y distancia cambiando juntas a lo largo de una única trayectoria de cámara cerrada.

La versión actual está dirigida a un sujeto humano claro. No está diseñada para animales, objetos generales, multitudes ni la reconstrucción exacta de una escena 3D completa.

Comparación con una línea base Qwen de múltiples ángulos

El repositorio fuente incluye una comparación práctica cara a cara con un LoRA de múltiples ángulos Qwen-Image-Edit 2511 ejecutado con un programa Lightning de 4 pasos. Ambos lados reciben la imagen fuente original de forma independiente para cada fotograma generado, y todas las salidas son el primer resultado de un prompt y una semilla fijos.

Comparación de una órbita horizontal de 360 grados entre la línea base Qwen de múltiples ángulos y Anygles.

El autor señala que se trata de una comparación de características y no de una ablación con acondicionamiento idéntico, ya que la línea base Qwen no recibe la normal objetivo que utiliza Anygles.

Cómo funciona

  1. Una malla humana se recupera una vez de la imagen fuente con SAM 3D Body.
  2. La malla se gira alrededor de la pelvis y se renderiza como una normal objetivo alineada dentro de un lienzo que coincide con la relación de aspecto de la fuente.
  3. La imagen original sigue siendo la referencia semántica y de identidad para Krea 2.
  4. La normal objetivo se codifica con el VAE y se inyecta a través de la proyección del Control-LoRA espacial en la entrada de imagen ruidosa.
  5. Una frase breve de cámara relativa transmite la semántica de la vista deseada. Los ángulos internos se normalizan a la convención de entrenamiento; por ejemplo, una solicitud de 50 grados a la derecha se envía como 310 grados a la izquierda, mientras que la interfaz mantiene controles con signo.

Ejecútalo en ComfyUI

Instala los nodos:

cd ComfyUI/custom_nodes
git clone https://github.com/alexw5702-afk/krea2-anygles
cd krea2-anygles
pip install -r requirements.txt

Acepta la licencia de SAM 3D Body y descarga el checkpoint de malla humana, luego coloca el LoRA en la carpeta habitual:

hf download facebook/sam-3d-body-dinov3 --local-dir ComfyUI/models/sam3d_body
ArchivoDestino
krea2_anygles_rank32.safetensorsComfyUI/models/loras
krea2_turbo_int8_convrot.safetensorsComfyUI/models/diffusion_models
qwen3vl_4b_fp8_scaled.safetensorsComfyUI/models/text_encoders
qwen_image_vae.safetensorsComfyUI/models/vae
sam-3d-body-dinov3ComfyUI/models/sam3d_body

El paquete de nodos añade cuatro nodos:

  1. Krea2 Anygles Camera redimensiona la fuente a un lienzo alineado, recupera la malla humana, la gira con guiñada, elevación y distancia, renderiza la normal objetivo y ensambla el prompt de cámara.
  2. Krea2 Anygles Encode envía la fuente a Qwen3-VL y a la ruta de referencia limpia de Krea 2, y codifica la normal objetivo de todo el lienzo.
  3. Krea2 Anygles Load LoRA aplica el adaptador y conserva su proyección espacial en lugar de descartar ese tensor no estándar.
  4. Krea2 Anygles Model Patch inyecta los tokens de normal alineados en la entrada de imagen ruidosa y almacena en caché la K/V de referencia visual limpia.

Configuraciones recomendadas de la model card: 8 pasos, Euler, scheduler simple, CFG 1.0, fuerza del adaptador 1.0, referencia VLM y caché de K/V de referencia habilitadas. SAM 3D Body y Krea 2 se ejecutan de forma secuencial, por lo que ambos modelos completos nunca necesitan estar en la GPU al mismo tiempo.

Disponibilidad

  • Pesos del LoRA: yijunwang2/krea2-anygles en Hugging Face, un único archivo de rango 32.
  • Nodos de ComfyUI y flujo de trabajo: alexw5702-afk/krea2-anygles en GitHub.
  • Demo Space: yijunwang2/krea2-anygles para probar el adaptador sin una instalación local.
  • Ruta portátil de Python: el repositorio incluye prepare_normal.py y example.py para ejecutarlo fuera de ComfyUI con el pipeline de Diffusers.

Esta es una versión no oficial de la comunidad. Los lados ocultos y el contenido del fondo se generan en lugar de recuperarse a partir de geometría medida, por lo que accesorios, texto, dedos y detalles ocluidos pueden cambiar, y los movimientos grandes de cámara pueden alterar la iluminación o las proporciones corporales. Una recuperación corporal deficiente, una oclusión severa, sujetos diminutos o varias personas pueden producir un control de normales incorrecto.

Comentarios

Inicia sesión con GitHub para unirte a la conversación.

Cargando comentarios…
Krea 2 Anygles: LoRA de control de cámara para ComfyUI | ComfyUI Wiki