LoRA Qwen-Image 2.1 Fix: Configuraciones corregidas para ComfyUI
Qwen-Image 2.1 Fix es un LoRA de la comunidad con un flujo de trabajo de ComfyUI de 20 pasos complementario, dirigido a los colores deslavados y la textura fina rota del modelo.
Una de las comparaciones antes/después publicadas con el modelo. Cada imagen compara el Qwen-Image 2.1 original con el LoRA en las configuraciones recomendadas.
Qué intenta corregir
Qwen-Image 2.1 llegó el 20 de septiembre con una fuerte adherencia al prompt y una compacta columna vertebral visual de 7B, y las quejas llegaron en menos de un día. Las dos recurrentes son estéticas más que estructurales: la textura fina se degrada de una forma que los probadores describen como manchado al estilo gpt-image, y los colores salen más planos y deslavados de lo que el prompt implica. El renderizado de manos y dedos fue lo otro marcado repetidamente en las primeras pruebas.
Qwen-Image 2.1 Fix es la respuesta de un autor: un adaptador pequeño (qwen-image-2.1-fix-1.0-comfy.safetensors, unos 112 MB, en formato de archivo único de ComfyUI) que no está pensado para colocarse en un flujo de trabajo cualquiera. La tarjeta del modelo lo dice sin rodeos: solo afirma que corrige la mayoría de los problemas de generación cuando se usa con las configuraciones adecuadas, y remite a la descarga del flujo de trabajo para saber cuáles son esas configuraciones.
Las configuraciones recomendadas
El flujo de trabajo en sí es donde reside la información útil, y es específico sobre la ruta del muestreador, no solo sobre la fuerza del LoRA:
| Configuración | Valor |
|---|---|
| Fuerza del LoRA | 1.0 mediante LoraLoaderModelOnly |
| Pasos | 20 |
| CFG | 3 |
| Muestreador | seeds_2 |
| Scheduler | sgm_uniform |
| Denoise | 1.0 |
| Orientación | APG en 1, 10, 0.3 más FreSca en 1, 2, 8 |
| Resolución | 1200 x 1600 |
Los dos nodos de orientación importan. APG (guía adaptativa proyectada) y FreSca (escalado separado por frecuencia de la guía libre de clasificador) son ambos nodos centrales de ComfyUI, por lo que vienen con la aplicación en lugar de requerir un paquete personalizado, y el flujo de trabajo los conecta antes del muestreador en lugar de depender solo del valor de CFG.
El lado del prompt es igual de tajante. El prompt muestreado pasa por un nodo TextEncodeQwenImage21 con un prompt negativo explícito que nombra directamente los modos de fallo:
artifacts, gpt-image, washed-out colors, low quality, low resolution, AI slop,
deviantart, sloppy lines, rough sketch, blurry, indistinct, missing fingers,
badly drawn hands, wrong number of fingersEl flujo de trabajo también carga Qwen-Image 2.1 en su forma cuantizada (qwen_image_2.1_int8_convrot, qwen3vl_8b_int8_convrot, qwen_image_2.1_vae_bf16), que es lo que usan las plantillas propias de ComfyUI.
Otra comparación publicada. El repositorio incluye 15 de estas.
Instalando
El adaptador es un LoRA normal de ComfyUI, así que el proceso es corto:
- Descarga el repositorio completo y coloca
qwen-image-2.1-fix-1.0-comfy.safetensorsenComfyUI/models/loras/. - Descomprime
Qwen Edit 2.1 Optimal Settings.json.zipy arrastra el JSON a ComfyUI. - Apunta el cargador al archivo LoRA. Ten en cuenta la discrepancia en el nombre de archivo: el flujo de trabajo hace referencia a un
qwen-image-2.1-fix-1.0.safetensorssin más, dentro de una subcarpetaqwen2.1/, que es la estructura propia del autor, no lo que incluye el repositorio.
Además, el flujo de trabajo no es puramente de nodos centrales. Junto a los nodos de orientación APG y FreSca, usa nodos de conveniencia para la generación de texto de prompt y nombres de archivo con marca de tiempo, por lo que una instalación básica reportará algunos nodos faltantes antes de ejecutarse.
Advertencias
Se trata de un adaptador de la comunidad de un solo autor, no de una corrección oficial, y se ha difundido sobre todo de boca en boca: llegó a r/StableDiffusion y r/comfyui el mismo día en que apareció, con comentaristas reportando resultados que iban de limpios a inutilizables antes de que el autor publicara un archivo de pesos corregido. Los primeros usuarios tampoco coincidieron sobre si la mejora proviene del LoRA o de las configuraciones de orientación y prompt negativo incluidas en el flujo de trabajo, un argumento razonable a tener en cuenta al leer las comparaciones.
Una tercera comparación publicada.
Comentarios
Inicia sesión con GitHub para unirte a la conversación.