ComfyUI-MiniMaxH3-CLIPCached: H3 조건화를 위한 디스크 캐시
새로운 ComfyUI 노드가 MiniMax H3 Qwen3-VL 조건화를 디스크에 캐시합니다. 동일한 프롬프트로 반복 실행 시 14.6GB 인코더를 건너뛰어 조건화 시간이 29.9초에서 1.1초로 단축됩니다.
캐시된 노드가 기본 H3 조건화 노드를 대체하며, 디퓨전 단계는 변경되지 않습니다.
캐시 대상과 제외 대상
이 노드는 샘플링 가속기가 아닙니다. TeaCache나 FirstBlockCache가 아니며 샘플링 단계에는 영향을 주지 않습니다. 이 노드는 ComfyUI의 기본 H3 조건화 노드를 대체합니다. 캐시 적중 시 이전에 계산된 텍스트/비전 조건화를 디스크에서 로드하고 Qwen3-VL 인코더를 실행하지 않으며, 디퓨전 단계는 변경 없이 진행됩니다.
| 변경 사항 | 새 캐시 항목 생성 여부 |
|---|---|
| 프롬프트 텍스트 | 예 |
| 인코더 체크포인트 | 예 |
| 인코더에 표시되는 키프레임/레퍼런스 픽셀 | 예, 인코더에 표시되는 콘텐츠가 변경된 경우 |
| 시드, 샘플러, 스케줄러, 단계 수 | 아니요 |
| 다운스트림 LoRA 또는 강도 | 아니요 |
이러한 구분은 반복적인 워크플로에서 중요합니다. 동일한 프롬프트로 샘플러 설정이나 LoRA 가중치만 변경하며 다시 실행하는 경우, 첫 번째 실행 이후부터는 모두 캐시 적중이 됩니다.
측정 수치
작성자의 통제된 벤치마크(모드별 5회 실행, 중앙값, WSL2 환경의 RTX 5080 16GB, 네이티브 및 미스 모드에서 의도적으로 콜드 인코더 읽기):
| 모드 | 조건화 | 최대 VRAM | 최대 프로세스 RAM |
|---|---|---|---|
| 네이티브 | 29.85초 | 15.24GiB | 29.25GiB |
| 캐시 미스 | 32.23초 | 15.24GiB | 28.25GiB |
| 캐시 적중 | 1.12초 | 2.67GiB | 3.38GiB |
미스는 의도적으로 빠른 경로가 아닙니다. 여전히 인코더를 실행하고 결과를 디스크에 기록하므로 약 2초가 추가로 소요됩니다. 하지만 인코딩 후 인코더는 메모리에 상주하지 않고 언로드되므로, 해당 메모리가 해제된 상태로 샘플링이 실행됩니다. 작성자의 스크린샷에서 네이티브 모드는 샘플링 중 11.7GB H3 모델과 14.6GB 인코더를 모두 상주 상태로 유지하는 반면, 캐시 적중 시에는 DiT만 로드되고 프로세스 RAM이 40GB에서 25.5GB로 감소합니다.
노드 및 캐시 관리
이 팩에는 기본 H3 이미지 기반 비디오 생성(FL2VA) 및 레퍼런스 기반 비디오 생성(Ref2VA) 노드의 캐시 대응 버전과, 기본 패스와 업스케일 대상 모두에 대한 조건화를 준비하는 이중 해상도 변형, 공유 인코더 이름 선택기가 포함되어 있습니다.
모든 고유한 조건화 요청은 삭제될 때까지 유지되는 캐시 항목이 되며, 반복 작업이 많으면 항목이 누적됩니다. 내장된 캐시 매니저 패널에서 항목을 탐색하고 태그를 지정하며 정리할 수 있습니다. 요구 사항은 네이티브 H3 노드가 포함된 ComfyUI 0.30.0 이상입니다.
사용 가능 여부
이 노드는 ComfyUI Manager와 레지스트리에서 minimaxh3-clipcached로 확인할 수 있으며, 저장소를 custom_nodes에 복제할 수도 있습니다. 현재 버전에는 자동 캐시 제거 기능이 없고, Ref2VA는 고정 레퍼런스 슬롯을 사용하며, GGUF 인코더는 테스트되지 않았습니다.
댓글
GitHub로 로그인하고 토론에 참여하세요.