- Inicio
- Models
- Qwen Image
- Qwen-Image: Modelo de generación de imagen a texto para ComfyUI - Descarga y guía
Qwen-Image: Modelo de generación de imagen a texto para ComfyUI - Descarga y guía
ComfyUI Wiki
Qwen-Image es el modelo fundacional de generación de imágenes de Alibaba con fuertes capacidades de renderizado de texto y edición. Disponible en múltiples formatos de cuantización para ComfyUI.
Q
Qwen-Image
Texto a ImagenRenderizado de TextoEdición de ImágenesCuantizadoModelo fundacional de generación de texto a imagen de la serie Qwen de Alibaba. Construido sobre una arquitectura de transformer de difusión, destaca en el renderizado de texto complejo (especialmente chino), edición precisa de imágenes y generación de imágenes general con soporte para diversos estilos artísticos. Disponible en variantes BF16, FP8, FP8 mixto, NVFP4 y resolución 2.5K.
| Desarrollador | Alibaba Cloud (Equipo Qwen) |
| Fecha de lanzamiento | 2025-08-04 |
| Arquitectura | Diffusion Transformer (DiT) |
| Licencia | Apache 2.0 |
| Codificador de texto | Qwen2.5-VL-7B |
| Pipeline | Diffusers (texto a imagen) |
| ControlNets | InstantX Union/Inpainting, DiffSynth Canny/Depth/Inpaint |
Guides and workflows related to this model series.
No articles found.
Comentarios
Inicia sesión con GitHub para unirte a la conversación.