Qwen-Image : modèle de génération texte vers image pour ComfyUI - Téléchargement et guide

ComfyUI Wiki

Qwen-Image est le modèle de génération d'images fondamental d'Alibaba avec de solides capacités de rendu de texte et d'édition. Disponible en plusieurs formats de quantification pour ComfyUI.

Q

Qwen-Image

Texte vers ImageRendu de texteÉdition d'imageQuantifié

Modèle fondamental de génération texte-vers-image de la série Qwen d'Alibaba. Construit sur une architecture de diffusion transformer, il excelle dans le rendu de texte complexe (notamment le chinois), l'édition d'images précise et la génération d'images généraliste avec prise en charge de styles artistiques variés. Disponible en variantes BF16, FP8, FP8 mixte, NVFP4 et résolution 2,5K.

DéveloppeurAlibaba Cloud (Qwen Team)
Date de sortie2025-08-04
ArchitectureDiffusion Transformer (DiT)
LicenceApache 2.0
Encodeur de texteQwen2.5-VL-7B
PipelineDiffusers (texte vers image)
ControlNetsInstantX Union/Inpainting, DiffSynth Canny/Depth/Inpaint

Guides and workflows related to this model series.

No articles found.

Commentaires

Connectez-vous avec GitHub pour rejoindre la discussion.

Chargement des commentaires…