LTX 2.3 图像:仅图像 LTX 模型获得 ComfyUI 路径

ComfyUI Wikinews

新的 ComfyUI PR 添加了仅图像 LTXV 2.3 模型路径,包含 13B 开发专用和蒸馏模型、无需 CFG 的 8 步蒸馏采样以及 int8 convrot 构建。

LTX 2.3 一直以来是一个视频和音频模型,但事实证明相同的骨干网络也能成为强大的静态图像生成器。elismasilvaComfyUI 提交的新 拉取请求 为 LTXV 2.3 模型添加了专用的仅图像模型路径 (ltxv_image),并附带一个 Hugging Face 仓库,提供四个针对文生图剪枝的统一 safetensors 模型。

LTX 2.3 开源

LTX 2.3:仅图像模型剪枝自该音视频基础模型

PR 新增内容

该拉取请求通过新的 LTXVImage / LTXVImageModel 对路由仅图像 LTXV 2.3 模型,仅在模型元数据将模型标记为 image_model="ltxv_image" 时选择。现有的 LTX 视频路径保持不变,继续实例化当前的 LTXVModel。除了加载器之外,该 PR 还带来了:

  • 可选的门控注意力 在 LTXV 变换器块中(默认关闭)。
  • 按块 STG 扰动路由 用于 LTXV 自注意力。
  • LTXVGuidanceRescale,一个实现 Diffusers 风格引导缩放的新节点。
  • 两个蓝图文本生成图像 (LTX-2.3 图像 开发专用)文本生成图像 (LTX-2.3 图像 蒸馏),注册在 图像生成与编辑/文本生成图像 下。

该 PR 于 2026 年 8 月 28 日开放,尚未合并。在 ltxv_image 路径合并到上游之前,可以在作者的 ComfyUI 分支 上测试这些模型。

模型文件

elismasilva/ltx2.3-image-comfyui 中的四个文件源自 Lightricks 的 LTX 2.3 系列,经过剪枝以移除视频和音频执行路径。不涉及新训练:权重被转换为统一的 ComfyUI 模型并放入 models/checkpoints/

文件变体
ltx-2.3-13b-image-dev.safetensors开发专用,bf16
ltx-2.3-13b-image-distilled.safetensors蒸馏,bf16
ltx-2.3-13b-image-dev-convrot-int8.safetensors开发专用,convrot int8 量化
ltx-2.3-13b-image-distilled-convrot-int8.safetensors蒸馏,convrot int8 量化

13b 名称指的是从原始较大的 LTX 2.3 包剪枝后的有效大小。int8 convrot 构建版以牺牲部分保真度换取更低的显存使用。

建议设置

模型卡片为每个变体提供了起点:

开发专用蒸馏
步数20 到 408
CFG3.0 到 5.01.0 (无需 CFG)
PAG 缩放~0.8 (可选)~0.8 (可选)
引导缩放~0.7 (可选)~0.7 (可选)

PR 中的两个蓝图都暴露了提示词、分辨率、步数、引导以及 PAG/引导缩放控制,因此上述设置直接映射到提供的工作流中。

这些蓝图需要来自 PR #15953 或作者的 ltxv-image-only 分支 的 ltxv_image 模型路径。在 PR 合并之前,它们无法在当前上游 ComfyUI 上加载。

为何视频模型需要图像路径

Lightricks 的 LTX-2.3 是一个联合音视频基础模型,仅图像剪枝是其他视频家族采取的方向:剥离时间和音频权重,保留空间先验,您将获得一个快速文生图模型,继承基础模型的提示词遵循度。对于已经在 ComfyUI 中使用 LTX 2.3 进行视频的用户,图像模型重用相同的文本编码器和加载约定,因此尝试文生图的成本仅略高于模型下载。如果 PR 合并,LTX 2.3 将在核心 ComfyUI 内同时覆盖静态图像和视频,无需额外的节点包。

评论

使用 GitHub 登录后即可参与讨论。

评论加载中…
LTX 2.3 图像:仅图像 LTX 模型获得 ComfyUI 路径 | ComfyUI Wiki