ComfyUI v0.32.0:全新原生注意力后端与 LTX 2.5 支持

ComfyUI Wikinews

ComfyUI v0.32.0 新增内置注意力后端,速度媲美 SageAttention;原生支持 LTX 2.5(含 STG 与双 CFG);修复 MiniMax H3 VAE 与内存问题;并更新合作节点。

ComfyUI v0.32.0 现已可用。此版本新增了内置注意力后端(comfy kitchen attention),无需额外安装即可达到 SageAttention 级别的速度;新增原生 LTX 2.5 支持;优化了 MiniMax H3 VAE 与内存;并更新了合作节点,包括 Qwen Image 3.0 和 Grok Imagine 2.0。

新增内置注意力后端

v0.32.0 实现了 comfy kitchen attention,这是一个随 ComfyUI 一并提供的原生注意力后端。新增的 ModelAttentionBackend 节点让您可以直接在工作流中为每个模型选择注意力实现,目前提供 PyTorch 注意力或 comfy kitchen attention。对于希望全局启用它的用户,--use-ck-attention 启动参数可将其设置为全部模型的默认后端(需要注意的是,它可能会导致某些模型无法正常工作)。

早期的社区基准测试表明,其性能与 SageAttention 相当。在 MiniMax H3 上,它与 SageAttention Auto 表现持平;在 Z-Image Turbo 2048x2048 @ 9 步测试中,新后端耗时 14.55 秒,而 SageAttention (Auto) 为 14.24 秒,默认 PyTorch 注意力为 23.16 秒:

注意力后端Z-Image Turbo 2048x2048 @ 9 步(3 次运行平均)
Comfy Kitchen Attention14.55s
SageAttention (Auto)14.24s
PyTorch 注意力(默认)23.16s

对于在安装 SageAttention 时遇到困难的用户,由于该后端已内置于 ComfyUI,这一改动彻底消除了这一障碍。

原生 LTX 2.5 支持

ComfyUI 现已原生支持 LTX 2.5,包括时空引导(STG)、双 CFG 和时长预测。此版本还新增了以下 LTXV 节点:

  • LTXV Spatio-Temporal Guidance(LTXV 时空引导):用于 LTX 视频生成的 STG 引导
  • LTXV Modality Guidance(LTXV 模态引导):用于 LTX 的音频/视频耦合引导
  • LTXV Dual CFG Guider(LTXV 双 CFG 引导器):用于 LTX 工作流的双 CFG 引导器
  • LTXV Duration Predictor(LTXV 时长预测器):根据提示词 token 预测自然的镜头时长

MiniMax H3 优化

v0.32.0 中的多项更改针对 MiniMax H3 生态系统:

  • 优化了 MiniMax-H3 VAE,编码和解码速度更快
  • 修复了 MiniMax H3 生成期间的峰值内存问题
  • 修复了 NestedTensor latents(MiniMax H3)上的 VAEDecodeTiled 崩溃问题

合作节点更新

  • Qwen Image 3.0:新增 Qwen-Image 3.0 和 3.0 Pro 文生图与编辑节点
  • LTX 2.5:新增 LTX 2.5 文本/图像/音频转视频合作节点
  • Grok Imagine Image 2.0:新增 grok-imagine-image-2.0 模型支持

性能与稳定性

  • PyTorch 2.7 现在是官方支持的最低 PyTorch 版本
  • ER-SDE 噪波缩放器已扩展,支持对 h(t) 进行缩放
  • Mistral 和 Llama tokenizer 不再依赖 transformers
  • 修复了放大模型在非动态低显存(VRAM)上崩溃的问题
  • 修复了分块音频解码异常的问题
  • 修复了 CLIP Vision 回归问题
  • 使创建分层图像(Create Layered Image)更易于发现,标志更清晰

如需查看完整更新日志,请访问 官方 GitHub 发布页面ComfyUI 文档更新日志

评论

使用 GitHub 登录后即可参与讨论。

评论加载中…
ComfyUI v0.32.0:全新原生注意力后端与 LTX 2.5 支持 | ComfyUI Wiki