Qwen-Image 2.1 Fix LoRA : paramètres corrigés pour ComfyUI

ComfyUI Wikinews

Qwen-Image 2.1 Fix est un LoRA communautaire livré avec un flux de travail ComfyUI en 20 étapes, destiné aux couleurs délavées du modèle et à sa texture fine dégradée.

Qwen-Image 2.1 Fix est un LoRA communautaire pour Qwen-Image 2.1 d'Alibaba qui cible les défauts les plus critiqués du modèle, et il est livré avec la partie que la plupart des sorties de LoRA oublient : un flux de travail ComfyUI de 20 nœuds qui embarque les réglages exacts d'échantillonneur, de guidance et de prompt négatif sur lesquels l'adaptateur a été calibré.
Comparaison Qwen-Image 2.1 Fix

L'une des comparaisons avant/après publiées avec le modèle. Chaque image oppose Qwen-Image 2.1 d'origine au LoRA avec les paramètres recommandés.

Ce qu'il cherche à corriger

Qwen-Image 2.1 est arrivé le 20 septembre avec une excellente fidélité au prompt et un backbone visuel compact de 7B, et les critiques ont suivi en l'espace d'une journée. Les deux récurrentes sont esthétiques plutôt que structurelles : la texture fine se dégrade d'une manière que les testeurs décrivent comme des taches de style gpt-image, et les couleurs ressortent plus plates et plus délavées que le prompt ne le laisse supposer. Le rendu des mains et des doigts était l'autre point signalé à plusieurs reprises lors des premiers tests.

Qwen-Image 2.1 Fix est la réponse d'un auteur : un petit adaptateur (qwen-image-2.1-fix-1.0-comfy.safetensors, environ 112 Mo, au format fichier unique de ComfyUI) qui n'est pas destiné à être déposé dans un flux de travail arbitraire. La carte du modèle est sans détour à ce sujet : elle indique seulement qu'il corrige la plupart des problèmes de génération lorsqu'il est utilisé avec les bons paramètres, et renvoie au téléchargement du flux de travail pour savoir quels sont ces paramètres.

Les paramètres recommandés

C'est dans le flux de travail lui-même que se trouvent les informations utiles, et il est précis sur le chemin de l'échantillonneur, pas seulement sur la force du LoRA :

ParamètreValeur
Force du LoRA1.0 via LoraLoaderModelOnly
Étapes20
CFG3
Échantillonneurseeds_2
Schedulersgm_uniform
Denoise1.0
GuidanceAPG à 1, 10, 0.3 plus FreSca à 1, 2, 8
Résolution1200 x 1600

Les deux nœuds de guidance comptent. APG (Guidance Adaptatif Projeté) et FreSca (mise à l'échelle séparée par fréquence de la guidance sans classifieur) sont tous deux des nœuds natifs de ComfyUI : ils sont fournis avec l'application et n'exigent aucun pack personnalisé, et le flux de travail les câble en amont de l'échantillonneur plutôt que de se fier au seul CFG.

Le côté prompt est tout aussi tranché. Le prompt échantillonné passe par un nœud TextEncodeQwenImage21 avec un prompt négatif explicite qui nomme directement les modes de défaillance :

artifacts, gpt-image, washed-out colors, low quality, low resolution, AI slop,
deviantart, sloppy lines, rough sketch, blurry, indistinct, missing fingers,
badly drawn hands, wrong number of fingers

Le flux de travail charge aussi Qwen-Image 2.1 dans sa forme quantifiée (qwen_image_2.1_int8_convrot, qwen3vl_8b_int8_convrot, qwen_image_2.1_vae_bf16), ce que les modèles officiels de ComfyUI utilisent également.

Exemple de comparaison

Une autre comparaison publiée. Le référentiel en propose 15 de ce type.

Installation

L'adaptateur est un LoRA ComfyUI classique, le chemin est donc court :

  1. Téléchargez le référentiel complet et placez qwen-image-2.1-fix-1.0-comfy.safetensors dans ComfyUI/models/loras/.
  2. Décompressez Qwen Edit 2.1 Optimal Settings.json.zip et glissez le JSON dans ComfyUI.
  3. Pointez le loader vers le fichier LoRA. Attention au décalage de nom de fichier : le flux de travail référence un simple qwen-image-2.1-fix-1.0.safetensors dans un sous-dossier qwen2.1/, ce qui correspond à l'arborescence personnelle de l'auteur, et non à ce que fournit le référentiel.

Le flux de travail n'est pas non plus purement natif. Outre les nœuds de guidance APG et FreSca, il utilise des nœuds utilitaires pour la génération de texte de prompt et les noms de fichiers horodatés ; une installation brute signalera donc quelques nœuds manquants avant de pouvoir s'exécuter.

Réserves

Il s'agit d'un adaptateur communautaire signé par un seul auteur, et non d'un correctif officiel, et il s'est surtout répandu par bouche à oreille : il est apparu sur r/StableDiffusion et r/comfyui le jour de sa sortie, avec des commentateurs signalant des résultats allant de propre à inutilisable avant que l'auteur ne publie un fichier de poids corrigé. Les premiers utilisateurs ne s'accordaient pas non plus sur la question de savoir si l'amélioration vient réellement du LoRA ou des paramètres de guidance et de prompt négatif intégrés au flux de travail, un argument raisonnable à garder en tête en lisant les comparaisons.

Exemple de comparaison

Une troisième comparaison publiée.

Commentaires

Connectez-vous avec GitHub pour rejoindre la discussion.

Chargement des commentaires…
Qwen-Image 2.1 Fix LoRA : paramètres corrigés pour ComfyUI | ComfyUI Wiki