Qwen-Image 2.1 Fix LoRA : paramètres corrigés pour ComfyUI
Qwen-Image 2.1 Fix est un LoRA communautaire livré avec un flux de travail ComfyUI en 20 étapes, destiné aux couleurs délavées du modèle et à sa texture fine dégradée.
L'une des comparaisons avant/après publiées avec le modèle. Chaque image oppose Qwen-Image 2.1 d'origine au LoRA avec les paramètres recommandés.
Ce qu'il cherche à corriger
Qwen-Image 2.1 est arrivé le 20 septembre avec une excellente fidélité au prompt et un backbone visuel compact de 7B, et les critiques ont suivi en l'espace d'une journée. Les deux récurrentes sont esthétiques plutôt que structurelles : la texture fine se dégrade d'une manière que les testeurs décrivent comme des taches de style gpt-image, et les couleurs ressortent plus plates et plus délavées que le prompt ne le laisse supposer. Le rendu des mains et des doigts était l'autre point signalé à plusieurs reprises lors des premiers tests.
Qwen-Image 2.1 Fix est la réponse d'un auteur : un petit adaptateur (qwen-image-2.1-fix-1.0-comfy.safetensors, environ 112 Mo, au format fichier unique de ComfyUI) qui n'est pas destiné à être déposé dans un flux de travail arbitraire. La carte du modèle est sans détour à ce sujet : elle indique seulement qu'il corrige la plupart des problèmes de génération lorsqu'il est utilisé avec les bons paramètres, et renvoie au téléchargement du flux de travail pour savoir quels sont ces paramètres.
Les paramètres recommandés
C'est dans le flux de travail lui-même que se trouvent les informations utiles, et il est précis sur le chemin de l'échantillonneur, pas seulement sur la force du LoRA :
| Paramètre | Valeur |
|---|---|
| Force du LoRA | 1.0 via LoraLoaderModelOnly |
| Étapes | 20 |
| CFG | 3 |
| Échantillonneur | seeds_2 |
| Scheduler | sgm_uniform |
| Denoise | 1.0 |
| Guidance | APG à 1, 10, 0.3 plus FreSca à 1, 2, 8 |
| Résolution | 1200 x 1600 |
Les deux nœuds de guidance comptent. APG (Guidance Adaptatif Projeté) et FreSca (mise à l'échelle séparée par fréquence de la guidance sans classifieur) sont tous deux des nœuds natifs de ComfyUI : ils sont fournis avec l'application et n'exigent aucun pack personnalisé, et le flux de travail les câble en amont de l'échantillonneur plutôt que de se fier au seul CFG.
Le côté prompt est tout aussi tranché. Le prompt échantillonné passe par un nœud TextEncodeQwenImage21 avec un prompt négatif explicite qui nomme directement les modes de défaillance :
artifacts, gpt-image, washed-out colors, low quality, low resolution, AI slop,
deviantart, sloppy lines, rough sketch, blurry, indistinct, missing fingers,
badly drawn hands, wrong number of fingersLe flux de travail charge aussi Qwen-Image 2.1 dans sa forme quantifiée (qwen_image_2.1_int8_convrot, qwen3vl_8b_int8_convrot, qwen_image_2.1_vae_bf16), ce que les modèles officiels de ComfyUI utilisent également.
Une autre comparaison publiée. Le référentiel en propose 15 de ce type.
Installation
L'adaptateur est un LoRA ComfyUI classique, le chemin est donc court :
- Téléchargez le référentiel complet et placez
qwen-image-2.1-fix-1.0-comfy.safetensorsdansComfyUI/models/loras/. - Décompressez
Qwen Edit 2.1 Optimal Settings.json.zipet glissez le JSON dans ComfyUI. - Pointez le loader vers le fichier LoRA. Attention au décalage de nom de fichier : le flux de travail référence un simple
qwen-image-2.1-fix-1.0.safetensorsdans un sous-dossierqwen2.1/, ce qui correspond à l'arborescence personnelle de l'auteur, et non à ce que fournit le référentiel.
Le flux de travail n'est pas non plus purement natif. Outre les nœuds de guidance APG et FreSca, il utilise des nœuds utilitaires pour la génération de texte de prompt et les noms de fichiers horodatés ; une installation brute signalera donc quelques nœuds manquants avant de pouvoir s'exécuter.
Réserves
Il s'agit d'un adaptateur communautaire signé par un seul auteur, et non d'un correctif officiel, et il s'est surtout répandu par bouche à oreille : il est apparu sur r/StableDiffusion et r/comfyui le jour de sa sortie, avec des commentateurs signalant des résultats allant de propre à inutilisable avant que l'auteur ne publie un fichier de poids corrigé. Les premiers utilisateurs ne s'accordaient pas non plus sur la question de savoir si l'amélioration vient réellement du LoRA ou des paramètres de guidance et de prompt négatif intégrés au flux de travail, un argument raisonnable à garder en tête en lisant les comparaisons.
Une troisième comparaison publiée.
Commentaires
Connectez-vous avec GitHub pour rejoindre la discussion.