Noticias de ComfyUI y lanzamientos de IA de código abierto

Novedades del ecosistema ComfyUI: lanzamientos de modelos de código abierto, nodos personalizados, flujos de trabajo y herramientas de generación de imagen, video y audio.

Texto a imagen

Tencent publica Hunyuan Image 3.0 como código abierto - Modelo de generación de imágenes a partir de texto más grande del mundo

Texto a imagen
Modelo base
Tencent publica Hunyuan Image 3.0 como código abierto - Modelo de generación de imágenes a partir de texto más grande del mundo

Tencent lanza Hunyuan Image 3.0, el primer modelo nativo de generación de imágenes multimodal comercial de código abierto con un total de 80 mil millones de parámetros, que cuenta con capacidades de razonamiento basadas en conocimientos del mundo y admite comprensión semántica compleja de miles de caracteres

Open-Weights

Animación de personajes

Alibaba lanza el modelo Wan-Animate - Tecnología unificada de animación y reemplazo de personajes

Animación de personajes
Herramienta
Alibaba lanza el modelo Wan-Animate - Tecnología unificada de animación y reemplazo de personajes

El Laboratorio Tongyi de Alibaba presenta Wan-Animate, un marco unificado de animación de personajes basado en Wan2.2, que admite la generación de animación de personajes y el reemplazo de personajes en videos, con pesos de modelo e inferencia de código de código abierto

Open-Weights

Imagen a vídeo

Lanzamiento de InfiniteTalk de código abierto - Tecnología de generación de video impulsada por audio con soporte de longitud ilimitada

Imagen a vídeo
Modelo base
Lanzamiento de InfiniteTalk de código abierto - Tecnología de generación de video impulsada por audio con soporte de longitud ilimitada

El equipo de MeiGen-AI ha publicado como código abierto el modelo InfiniteTalk, que permite la sincronización precisa de labios y la generación de videos de longitud ilimitada. Soporta conversión de imagen a video y de video a video, marcando un avance en la tecnología de humanos digitales.

MIT

Texto a imagen
Modelo base
Qwen-Image obtiene soporte nativo en ComfyUI

Qwen-Image es un modelo MMDiT de 20B centrado en el renderizado de texto complejo y la edición precisa; ya puede usarse de forma nativa en ComfyUI. Este artículo resume sus capacidades clave, licencia y recursos.

Open-Weights

Texto a imagen

Black Forest Labs Lanza la Versión de Código Abierto FLUX.1 Krea [dev] con Soporte Nativo de ComfyUI

Texto a imagen
Modelo base
Black Forest Labs Lanza la Versión de Código Abierto FLUX.1 Krea [dev] con Soporte Nativo de ComfyUI

La colaboración entre Black Forest Labs y Krea lanza oficialmente el modelo FLUX.1 Krea [dev], el mejor modelo FLUX de código abierto para generación de texto a imagen. ComfyUI ha implementado soporte nativo, permitiendo a los usuarios experimentar la última tecnología de generación de texto a imagen.

FLUX-1-dev-non-commercial

Texto a vídeo

Lanzamiento de la versión open source de WAN2.2 y soporte nativo en ComfyUI desde el primer día

Texto a vídeo
Modelo base
Lanzamiento de la versión open source de WAN2.2 y soporte nativo en ComfyUI desde el primer día

El equipo de WAN lanza oficialmente la versión open source de Wan2.2, que incorpora una arquitectura MoE innovadora y mejora notablemente la calidad en la generación de video. ComfyUI ya ofrece soporte nativo, permitiendo a los usuarios experimentar directamente la nueva tecnología de generación de video.

Open-Weights