ComfyUI-MiniMaxH3-CLIPCached 节点:H3 条件的磁盘缓存
新增的 ComfyUI 节点将 MiniMax H3 Qwen3-VL 条件缓存至磁盘:使用相同提示词重复运行时跳过 14.6 GB 编码器,条件处理时间从 29.9 秒降至 1.1 秒。
缓存节点取代了内置的 H3 条件节点;扩散阶段保持不变。
它会缓存什么,不会缓存什么
这不是采样加速器。它不是 TeaCache 或 FirstBlockCache,也不会影响采样步数。该节点取代了 ComfyUI 内置的 H3 条件节点:缓存命中时,它会从磁盘加载先前计算好的文本/视觉条件,而不是运行 Qwen3-VL 编码器,扩散阶段则照常进行。
| 变更 | 是否新建缓存条目? |
|---|---|
| 提示词文本 | 是 |
| 编码器 checkpoint | 是 |
| 编码器可见的关键帧/参考像素 | 是,当编码器可见内容发生变化时 |
| 种子、采样器、调度器、步数 | 否 |
| 下游 LoRA 或强度 | 否 |
这一区分对迭代式工作流很重要:如果你重新运行相同的提示词,只调整采样器设置或 LoRA 权重,那么首次之后的每次运行都会命中缓存。
实测数据
作者的受控基准测试(每种模式 5 个案例,取中位数,WSL2 下的 RTX 5080 16 GB,原生与未命中模式均刻意采用冷编码器读取):
| 模式 | 条件处理 | 峰值显存 | 峰值进程内存 |
|---|---|---|---|
| 原生 | 29.85 秒 | 15.24 GiB | 29.25 GiB |
| 缓存未命中 | 32.23 秒 | 15.24 GiB | 28.25 GiB |
| 缓存命中 | 1.12 秒 | 2.67 GiB | 3.38 GiB |
未命中模式刻意不走快速路径:它仍会运行编码器并将结果写入磁盘,大约多花 2 秒。但编码完成后,编码器会被卸载而非常驻内存,因此采样可以在内存释放后运行。在作者的截图中,原生模式在采样时让 11.7 GB 的 H3 模型和 14.6 GB 的编码器同时常驻内存,而缓存命中时只加载 DiT,进程内存从 40 GB 降至 25.5 GB。
节点与缓存管理
该节点包包含内置的 H3 图生视频(FL2VA)和参考生视频(Ref2VA)节点的缓存版本,以及可同时为基础阶段和放大目标准备条件的双分辨率变体,外加一个共享的编码器名称选择器。
每个独特的条件请求都会成为一条缓存条目,并一直保留到被删除;如果频繁迭代,条目会不断累积。内置的缓存管理器面板可用于浏览、标记和清理条目。依赖项为 ComfyUI 0.30.0 或更高版本(需包含原生 H3 节点)。
获取方式
该节点已上架 ComfyUI Manager 和注册表,名称为 minimaxh3-clipcached,也可以将仓库克隆到 custom_nodes 目录。当前版本没有自动缓存淘汰机制,Ref2VA 使用固定的参考槽位,GGUF 编码器尚未经过测试。
评论
使用 GitHub 登录后即可参与讨论。