Qwen-Image: ComfyUI向けテキストから画像への生成モデル - ダウンロードとガイド

ComfyUI Wiki

Qwen-Imageは、Alibabaが開発した基礎画像生成モデルで、強力なテキストレンダリングと編集機能を備えています。ComfyUI向けに複数の量子化フォーマットが利用可能です。

Q

Qwen-Image

テキストから画像へテキストレンダリング画像編集量子化

AlibabaのQwenシリーズによる基礎テキストから画像への生成モデル。拡散トランスフォーマーアーキテクチャを採用し、複雑なテキストレンダリング(特に中国語)、高精度な画像編集、多様なアートスタイルをサポートする一般的な画像生成に優れています。BF16、FP8、FP8混合、NVFP4、2.5K解像度のバリエーションが利用可能です。

開発者Alibaba Cloud (Qwenチーム)
リリース日2025-08-04
アーキテクチャ拡散トランスフォーマー (DiT)
ライセンスApache 2.0
テキストエンコーダーQwen2.5-VL-7B
パイプラインDiffusers (テキストから画像へ)
ControlNetsInstantX Union/インペイント, DiffSynth Canny/Depth/インペイント

Guides and workflows related to this model series.

No articles found.

コメント

GitHubでサインインしてディスカッションに参加しましょう。

コメントを読み込み中…