LLaDA-Image Turbo: InclusionAIによる4ステップ生成と編集

ComfyUI Wiki

LLaDA-Image TurboはInclusionAIの6B統合画像モデルをTwin-DMDで2〜4ステップに蒸留し、ComfyUIでテキストから画像への生成とネイティブな指示編集を実行します。

L

LLaDA-Image Turbo

テキストから画像へ画像編集少数ステップ蒸留

InclusionAIの6B統合画像モデルをTwin-DMDで蒸留したバリアント。生成と編集の両方を2〜4サンプリングステップに圧縮しながら、ネイティブな編集パスを維持し、ComfyUI用のBF16およびINT8 transformer重みとして提供されます。

開発元InclusionAI (Ant Group)
リリース日2026-09-04
アーキテクチャ統合拡散バックボーン + DiT
パラメータ6B
ライセンスApache-2.0
推論2〜4ステップ、CFG 1.0

機能

  • テキストから画像への生成: Baseモデルでは50ステップ、Turboでは2〜4ステップ
  • 指示に基づく編集: デノイズ強度によるimg2imgの近似ではなく、参照を保持するモデルネイティブの編集パスを使用します。編集時のサイズは32で割り切れる必要があります
  • バイリンガルなテキスト描画: 生成画像内の中国語と英語のテキストを判読可能な形でレンダリング
  • VQ条件付け生成: SigVQ条件付けモジュール

ComfyUIでの使い方

コミュニティの RebelAIノードパック では、LLaDA Image Loader、LLaDA Image Text to Image、LLaDA Image Edit、LLaDA Image Unload の4つのノードが提供されています。

最適化済みの重みをそれぞれ対応するComfyUIフォルダに配置します:

ファイル配置先
LLaDA-Image-Turbo-transformer-BF16.safetensors または LLaDA-Image-Turbo-INT8.safetensorsComfyUI/models/diffusion_models/
LLaDA-Image-Turbo-text_encoder-Q4_K_M.ggufComfyUI/models/text_encoders/
LLaDa_VAE.safetensorsComfyUI/models/vae/

INT8 transformerはネイティブなsafetensors量子化です。GGUFは量子化されたLLaDA2-MoE text encoderにのみ使用します。まずは4ステップ、CFG 1.0から始めてください。

関連情報

Guides and workflows related to this model series.

No articles found.

コメント

GitHubでサインインしてディスカッションに参加しましょう。

コメントを読み込み中…