Qwen-Image 2.1 Fix LoRA:ComfyUI 的正确设置指南
Qwen-Image 2.1 Fix 是一款社区 LoRA,附带一套 20 步 ComfyUI 工作流,专门针对该模型色彩灰白、精细纹理崩坏的问题。
随模型发布的前后对比图之一。每张图都将原版 Qwen-Image 2.1 与推荐设置下的 LoRA 效果并排对比。
它试图修复什么
Qwen-Image 2.1 于 9 月 20 日发布,具备很强的提示词遵循能力和紧凑的 7B 视觉主干,而抱怨在一天之内就出现了。反复出现的两个问题并非结构性的,而是审美层面的:精细纹理会以测试者形容为 gpt-image 风格斑块的方式崩坏,颜色也比提示词所暗示的更平淡、更灰白。手部和手指的渲染是早期测试中另一个被反复标记的问题。
Qwen-Image 2.1 Fix 是作者给出的答案:一个小型适配器(qwen-image-2.1-fix-1.0-comfy.safetensors,约 112 MB,ComfyUI 单文件格式),它并不适合直接丢进任意工作流。模型卡片对此直言不讳,只说明在正确的设置下它能修复大多数生成问题,并指出这些设置就在可下载的工作流中。
推荐设置
真正有用的信息就在工作流里,而且它不只规定了 LoRA 强度,还明确指定了整条采样器路径:
| 设置 | 值 |
|---|---|
| LoRA 强度 | 通过 LoraLoaderModelOnly 设为 1.0 |
| 步数 | 20 |
| CFG | 3 |
| 采样器 | seeds_2 |
| 调度器 | sgm_uniform |
| 降噪 | 1.0 |
| 引导 | APG,参数为 1, 10, 0.3,外加 FreSca,参数为 1, 2, 8 |
| 分辨率 | 1200 x 1600 |
这两个引导节点很关键。APG(自适应投影引导)和 FreSca(频率分离的无分类器引导缩放)都是 ComfyUI 核心节点,因此随应用自带,无需额外安装自定义节点包;工作流把它们接在采样器之前,而不是仅依赖 CFG 数值。
提示词方面同样态度鲜明。采样用的提示词经过 TextEncodeQwenImage21 节点,并带有一段明确的负面提示词,直接点名各种故障表现:
artifacts, gpt-image, washed-out colors, low quality, low resolution, AI slop,
deviantart, sloppy lines, rough sketch, blurry, indistinct, missing fingers,
badly drawn hands, wrong number of fingers该工作流还以量化形式加载 Qwen-Image 2.1(qwen_image_2.1_int8_convrot、qwen3vl_8b_int8_convrot、qwen_image_2.1_vae_bf16),这正是 ComfyUI 自带模板所采用的形式。
另一组已发布的对比图。该仓库共附带 15 组这样的对比。
安装方法
该适配器就是普通的 ComfyUI LoRA,所以安装步骤很短:
- 下载完整仓库,将
qwen-image-2.1-fix-1.0-comfy.safetensors放入ComfyUI/models/loras/。 - 解压
Qwen Edit 2.1 Optimal Settings.json.zip,把 JSON 文件拖入 ComfyUI。 - 将加载器指向该 LoRA 文件。注意文件名不一致:工作流引用的是
qwen2.1/子目录下名为qwen-image-2.1-fix-1.0.safetensors的文件,那是作者自己的目录结构,并非仓库实际提供的内容。
这个工作流也并非纯核心节点。除了 APG 和 FreSca 引导节点外,它还使用了用于生成提示词文本和带时间戳文件名的便利节点,因此全新安装后运行前会提示若干缺失节点。
注意事项
这是单作者制作的社区适配器,并非官方修复,而且它主要靠口碑传播:发布当天就出现在 r/StableDiffusion 和 r/comfyui 上,评论者反馈的效果从干净到完全不可用都有,直到作者推送了修正后的权重文件。早期使用者之间也存在分歧:改进究竟来自 LoRA 本身,还是来自工作流中捆绑的引导与负面提示词设置。在阅读那些对比图时,这个论点值得放在心上。
第三组已发布的对比图。
评论
使用 GitHub 登录后即可参与讨论。