ComfyUI v0.32.0: backend de atención nativo y soporte para LTX 2.5

ComfyUI Wikinews

ComfyUI v0.32.0 añade un backend de atención que iguala a SageAttention, soporte nativo para LTX 2.5 con STG y CFG dual, correcciones de VAE y memoria de MiniMax H3 y nuevos nodos.

ComfyUI v0.32.0 ya está disponible. Esta versión añade un nuevo backend de atención integrado (comfy kitchen attention) que alcanza velocidades al nivel de SageAttention sin instalaciones adicionales, soporte nativo para LTX 2.5, optimizaciones de VAE y memoria de MiniMax H3, y nodos asociados actualizados, incluidos Qwen Image 3.0 y Grok Imagine 2.0.

Nuevo backend de atención integrado

v0.32.0 implementa comfy kitchen attention, un backend de atención nativo que se incluye con el propio ComfyUI. Un nuevo nodo ModelAttentionBackend permite seleccionar la implementación de atención por modelo directamente dentro de un flujo de trabajo, ofreciendo actualmente atención PyTorch o comfy kitchen attention. Para los usuarios que lo quieran en todas partes, el argumento de inicio --use-ck-attention lo habilita como backend predeterminado para todos los modelos (con la advertencia de que podría romper algunos).

Los primeros benchmarks de la comunidad lo sitúan a la par de SageAttention. En MiniMax H3 igualó a SageAttention Auto, y en una prueba de Z-Image Turbo 2048x2048 @ 9 pasos el nuevo backend tardó 14.55s, frente a los 14.24s de SageAttention (Auto) y los 23.16s de la atención PyTorch predeterminada:

Backend de atenciónZ-Image Turbo 2048x2048 @ 9 pasos (promedio de 3 ejecuciones)
Comfy Kitchen Attention14.55s
SageAttention (Auto)14.24s
Atención PyTorch (predeterminada)23.16s

Para los usuarios que tienen problemas para instalar SageAttention, esto elimina esa fricción por completo, ya que el backend está integrado en ComfyUI.

Soporte nativo para LTX 2.5

LTX 2.5 ahora es compatible de forma nativa con ComfyUI, con orientación espacio-temporal (STG), CFG dual y predicción de duración. Esta versión también añade los nuevos nodos LTXV:

  • LTXV Spatio-Temporal Guidance: orientación STG para la generación de vídeo LTX
  • LTXV Modality Guidance: orientación de acoplamiento de audio/vídeo para LTX
  • LTXV Dual CFG Guider: guía de CFG dual para flujos de trabajo LTX
  • LTXV Duration Predictor: predice una duración natural de toma a partir de los tokens del caption

Optimizaciones para MiniMax H3

Varios cambios en v0.32.0 están dirigidos al ecosistema MiniMax H3:

  • VAE MiniMax-H3 optimizado para codificación y decodificación más rápidas
  • Corregido el problema de pico de memoria con MiniMax H3 durante la generación
  • Corregido el bloqueo de VAEDecodeTiled en latents NestedTensor (MiniMax H3)

Actualizaciones de nodos asociados

  • Qwen Image 3.0: se añadieron nodos de texto a imagen y de edición para Qwen-Image 3.0 y 3.0 Pro
  • LTX 2.5: se añadieron nodos asociados de LTX 2.5 de Texto/Imagen/Audio a Vídeo
  • Grok Imagine Image 2.0: se añadió soporte para el modelo grok-imagine-image-2.0

Rendimiento y estabilidad

  • PyTorch 2.7 es ahora la versión de PyTorch mínima oficialmente compatible
  • Escalador de ruido ER-SDE ampliado mediante el escalado de h(t)
  • Los tokenizadores de Mistral y Llama ya no dependen de transformers
  • Corregido el problema de los modelos de upscale que fallaban con VRAM baja no dinámica
  • Corregido el problema de la decodificación de audio en mosaico
  • Corregida la regresión de CLIP Vision
  • Se hizo que Crear imagen por capas fuera detectable con indicadores más claros

Para el registro de cambios completo, visita el lanzamiento oficial de GitHub o el registro de cambios de la Documentación de ComfyUI.

Comentarios

Inicia sesión con GitHub para unirte a la conversación.

Cargando comentarios…
ComfyUI v0.32.0: backend de atención nativo y soporte para LTX 2.5 | ComfyUI Wiki