LLaDA-Image:InclusionAI 的 6B 图像生成与编辑模型

ComfyUI Wiki

LLaDA-Image 是 InclusionAI 开源的 6B 模型,支持文生图生成与原生指令编辑,并提供 4 步 Turbo 变体和社区 ComfyUI 节点包。

L

LLaDA-Image

文生图图像编辑6B文本渲染

来自 InclusionAI(蚂蚁集团)的开放 6B 统一图像模型。单个 checkpoint 同时处理文生图生成与原生指令引导编辑,支持中英双语文本渲染,并公开训练配方。LLaDA-Image Turbo 将流程蒸馏至 2 到 4 个采样步。

LLaDA-Image 是一个统一的 diffusion 模型,其 backbone 与 DiT 都是在同一套框架下训练的 diffusion 模型。它并非在文生图模型上外挂一个编辑附加模块,而是用单个 checkpoint 覆盖生成、带引用保持的指令引导编辑,以及通过 SigVQ 条件模块实现的 VQ 条件生成。

在 Qwen-Image-Bench 上,它的英文得分为 53.53,中文得分为 53.38,是发布时开放 6B 模型中的最佳综合成绩。完整的训练配方记录在随附的 arXiv 报告中。

模型

模型步数描述许可证发布日期
LLaDA-Image Turbo2-4为 ComfyUI 打包的 Twin-DMD 蒸馏变体(BF16 / INT8)Apache-2.02026-09-04

在上方选择一个模型,即可查看精选权重下载、教程及相关信息。

评论

使用 GitHub 登录后即可参与讨论。

评论加载中…