Qwen-Image 2.1 Fix LoRA: ComfyUIでの正しい設定ガイド

ComfyUI Wikinews

Qwen-Image 2.1 Fixは、20ステップのComfyUIワークフローを同梱したコミュニティ製LoRAです。モデルの色あせと崩れた細部の質感に対処します。

Qwen-Image 2.1 Fix は、AlibabaのQwen-Image 2.1における最も不満の声が多い欠陥に対処するコミュニティ製LoRAです。そして多くのLoRAリリースが省いてしまう部分、すなわちこのアダプターが調整された正確なサンプラー、ガイダンス、ネガティブプロンプトの設定をそのまま収めた20ノードのComfyUIワークフローを同梱しています。
Qwen-Image 2.1 Fix の比較

モデルとともに公開されたビフォーアフター比較の1つ。各画像は、素のQwen-Image 2.1と、推奨設定で適用したLoRAを並べたものです。

何を修正しようとしているのか

Qwen-Image 2.1は9月20日に登場し、高いプロンプト追従性とコンパクトな7Bのビジュアルバックボーンを備えていましたが、不満の声は翌日には上がり始めました。繰り返し指摘された2点は、構造的なものではなく美的なものでした。細部のテクスチャが崩れる、いわゆるgpt-imageスタイルの斑状のムラだとテスターが表現する現象と、色がプロンプトから連想されるよりも平坦で色あせて出力されることです。手や指の描画も、初期テストで繰り返しフラグが立てられたもう1つの問題でした。

Qwen-Image 2.1 Fixは、ある作者による答えです。小さなアダプター(qwen-image-2.1-fix-1.0-comfy.safetensors、約112 MB、ComfyUIの単一ファイル形式)であり、任意のワークフローにそのまま放り込むことを想定したものではありません。モデルカードもその点は率直で、適切な設定で使用した場合にほとんどの生成問題を修正するとだけ述べ、その設定についてはワークフローのダウンロードを参照するよう促しています。

推奨設定

有用な情報はワークフロー自体にあり、LoRA強度だけでなくサンプラーの経路まで具体的に指定されています。

設定
LoRA強度LoraLoaderModelOnly 経由で 1.0
ステップ数20
CFG3
サンプラーseeds_2
Schedulersgm_uniform
Denoise1.0
ガイダンスAPG1, 10, 0.3)+ FreSca1, 2, 8
解像度1200 x 1600

2つのガイダンスノードが重要です。APG(適応的投影ガイダンス)と FreSca(classifier-free guidanceの周波数分離スケーリング)はどちらもComfyUIのコアノードであり、カスタムパックを必要とせずアプリケーションに標準で付属します。ワークフローはこれらをCFG値だけに頼るのではなく、サンプラーの前段に接続しています。

プロンプト側も同様にこだわりがあります。サンプリングされるプロンプトは TextEncodeQwenImage21 ノードを通り、失敗モードを直接名指しした明示的なネガティブプロンプトを伴います。

artifacts, gpt-image, washed-out colors, low quality, low resolution, AI slop,
deviantart, sloppy lines, rough sketch, blurry, indistinct, missing fingers,
badly drawn hands, wrong number of fingers

また、このワークフローはQwen-Image 2.1を量子化された形式(qwen_image_2.1_int8_convrotqwen3vl_8b_int8_convrotqwen_image_2.1_vae_bf16)で読み込みます。これはComfyUI自身のテンプレートが使用している形式です。

比較サンプル

公開されているもう1つの比較。リポジトリにはこの比較画像が15枚含まれています。

インストール

このアダプターは通常のComfyUI LoRAなので、手順は短いです。

  1. リポジトリ全体をダウンロードし、qwen-image-2.1-fix-1.0-comfy.safetensorsComfyUI/models/loras/ に配置します。
  2. Qwen Edit 2.1 Optimal Settings.json.zip を解凍し、そのJSONをComfyUIにドラッグします。
  3. ローダーをLoRAファイルに向けます。ファイル名の不一致に注意してください。ワークフローは qwen2.1/ サブフォルダ内の素の qwen-image-2.1-fix-1.0.safetensors を参照していますが、これは作者自身のレイアウトであり、リポジトリが配布しているものではありません。

また、このワークフローは純粋にコアノードだけで構成されているわけでもありません。APGとFreScaのガイダンスノードに加えて、プロンプトテキストの生成やタイムスタンプ付きファイル名のための便利ノードも使用しているため、素のインストール環境では実行前にいくつか不足しているノードが報告されます。

注意点

これは公式の修正ではなく、単独の作者によるコミュニティ製アダプターであり、主に口コミで広まりました。登場した当日にr/StableDiffusionとr/comfyuiに投稿され、コメント投稿者からはクリーンな結果から使い物にならない結果まで幅広い報告があり、その後作者が修正済みの重みファイルを公開しました。また、初期の導入者たちの間では、改善がLoRA自体によるものなのか、ワークフローに同梱されたガイダンスとネガティブプロンプトの設定によるものなのかについても意見が分かれており、比較画像を読む際には頭に留めておくべき妥当な論点です。

比較サンプル

公開された3つ目の比較。

コメント

GitHubでサインインしてディスカッションに参加しましょう。

コメントを読み込み中…
Qwen-Image 2.1 Fix LoRA: ComfyUIでの正しい設定ガイド | ComfyUI Wiki