Qwen-Image: Modelo de generación de imagen a texto para ComfyUI - Descarga y guía

ComfyUI Wiki

Qwen-Image es el modelo fundacional de generación de imágenes de Alibaba con fuertes capacidades de renderizado de texto y edición. Disponible en múltiples formatos de cuantización para ComfyUI.

Q

Qwen-Image

Texto a ImagenRenderizado de TextoEdición de ImágenesCuantizado

Modelo fundacional de generación de texto a imagen de la serie Qwen de Alibaba. Construido sobre una arquitectura de transformer de difusión, destaca en el renderizado de texto complejo (especialmente chino), edición precisa de imágenes y generación de imágenes general con soporte para diversos estilos artísticos. Disponible en variantes BF16, FP8, FP8 mixto, NVFP4 y resolución 2.5K.

DesarrolladorAlibaba Cloud (Equipo Qwen)
Fecha de lanzamiento2025-08-04
ArquitecturaDiffusion Transformer (DiT)
LicenciaApache 2.0
Codificador de textoQwen2.5-VL-7B
PipelineDiffusers (texto a imagen)
ControlNetsInstantX Union/Inpainting, DiffSynth Canny/Depth/Inpaint

Guides and workflows related to this model series.

No articles found.

Comentarios

Inicia sesión con GitHub para unirte a la conversación.

Cargando comentarios…