LLaDA-Image Turbo:InclusionAI 的 4 步生成与编辑模型

ComfyUI Wiki

LLaDA-Image Turbo 通过 Twin-DMD 将 InclusionAI 的 6B 统一图像模型蒸馏到 2-4 步,可在 ComfyUI 中运行文生图与原生指令编辑。

L

LLaDA-Image Turbo

Text-to-ImageImage EditingFew-StepDistilled

InclusionAI 6B 统一图像模型的 Twin-DMD 蒸馏版本。将生成与编辑都压缩到 2 至 4 个采样步,同时保留原生编辑路径,并以 BF16 与 INT8 transformer 权重形式提供给 ComfyUI。

DeveloperInclusionAI(蚂蚁集团)
Release Date2026-09-04
Architecture统一扩散主干 + DiT
Parameters6B
LicenseApache-2.0
Inference2-4 步,CFG 1.0

功能

  • 文生图生成:Base 模型需 50 步,Turbo 仅需 2 至 4 步
  • 指令引导编辑:使用模型的原生编辑路径并保持引用一致性,而非基于降噪强度的 img2img 近似方案。编辑尺寸必须能被 32 整除
  • 双语文字渲染:生成图像中可呈现清晰的中文和英文文字
  • VQ 条件生成:SigVQ 条件模块

ComfyUI 使用方法

社区 RebelAI 节点包 提供四个节点:LLaDA Image Loader、LLaDA Image Text to Image、LLaDA Image Edit 和 LLaDA Image Unload。

将优化后的权重放入对应的 ComfyUI 文件夹:

文件目标位置
LLaDA-Image-Turbo-transformer-BF16.safetensors 或 LLaDA-Image-Turbo-INT8.safetensorsComfyUI/models/diffusion_models/
LLaDA-Image-Turbo-text_encoder-Q4_K_M.ggufComfyUI/models/text_encoders/
LLaDa_VAE.safetensorsComfyUI/models/vae/

INT8 transformer 是原生 safetensors 量化;GGUF 仅用于量化后的 LLaDA2-MoE 文本编码器。建议先从 4 步和 CFG 1.0 开始。

相关

Guides and workflows related to this model series.

No articles found.

评论

使用 GitHub 登录后即可参与讨论。

评论加载中…