LLaDA-Image:InclusionAI 的 6B 图像生成与编辑模型
ComfyUI Wiki
LLaDA-Image 是 InclusionAI 开源的 6B 模型,支持文生图生成与原生指令编辑,并提供 4 步 Turbo 变体和社区 ComfyUI 节点包。
L
LLaDA-Image
文生图图像编辑6B文本渲染来自 InclusionAI(蚂蚁集团)的开放 6B 统一图像模型。单个 checkpoint 同时处理文生图生成与原生指令引导编辑,支持中英双语文本渲染,并公开训练配方。LLaDA-Image Turbo 将流程蒸馏至 2 到 4 个采样步。
LLaDA-Image 是一个统一的 diffusion 模型,其 backbone 与 DiT 都是在同一套框架下训练的 diffusion 模型。它并非在文生图模型上外挂一个编辑附加模块,而是用单个 checkpoint 覆盖生成、带引用保持的指令引导编辑,以及通过 SigVQ 条件模块实现的 VQ 条件生成。
在 Qwen-Image-Bench 上,它的英文得分为 53.53,中文得分为 53.38,是发布时开放 6B 模型中的最佳综合成绩。完整的训练配方记录在随附的 arXiv 报告中。
模型
| 模型 | 步数 | 描述 | 许可证 | 发布日期 |
|---|---|---|---|---|
| LLaDA-Image Turbo | 2-4 | 为 ComfyUI 打包的 Twin-DMD 蒸馏变体(BF16 / INT8) | Apache-2.0 | 2026-09-04 |
在上方选择一个模型,即可查看精选权重下载、教程及相关信息。
评论
使用 GitHub 登录后即可参与讨论。