- Accueil
- Models
- Qwen Image
- Qwen-Image : modèle de génération texte vers image pour ComfyUI - Téléchargement et guide
Qwen-Image : modèle de génération texte vers image pour ComfyUI - Téléchargement et guide
ComfyUI Wiki
Qwen-Image est le modèle de génération d'images fondamental d'Alibaba avec de solides capacités de rendu de texte et d'édition. Disponible en plusieurs formats de quantification pour ComfyUI.
Q
Qwen-Image
Texte vers ImageRendu de texteÉdition d'imageQuantifiéModèle fondamental de génération texte-vers-image de la série Qwen d'Alibaba. Construit sur une architecture de diffusion transformer, il excelle dans le rendu de texte complexe (notamment le chinois), l'édition d'images précise et la génération d'images généraliste avec prise en charge de styles artistiques variés. Disponible en variantes BF16, FP8, FP8 mixte, NVFP4 et résolution 2,5K.
| Développeur | Alibaba Cloud (Qwen Team) |
| Date de sortie | 2025-08-04 |
| Architecture | Diffusion Transformer (DiT) |
| Licence | Apache 2.0 |
| Encodeur de texte | Qwen2.5-VL-7B |
| Pipeline | Diffusers (texte vers image) |
| ControlNets | InstantX Union/Inpainting, DiffSynth Canny/Depth/Inpaint |
Guides and workflows related to this model series.
No articles found.
Commentaires
Connectez-vous avec GitHub pour rejoindre la discussion.