HyperFlow: ComfyUI 포팅과 함께 등장한 8스텝 MiniMax H3 LoRA
Video Rebirth의 HyperFlow는 데이터 프리 자기 증류 LoRA로 MiniMax H3 샘플링을 49회 트랜스포머 포워드에서 8회로 줄입니다. 출시 직후 두 개의 ComfyUI 포팅이 이어졌습니다.
Video Rebirth가 MiniMax H3용 8스텝 LoRA인 HyperFlow를 공개했습니다. 이 LoRA는 베이스 모델의 49회 트랜스포머 포워드를 8회로 압축합니다. H3 가속 경쟁의 최신 항목이며, lightx2v와 ModelTC 증류와 달리 출시 며칠 만에 두 개의 독립적인 ComfyUI 포팅과 함께 등장했습니다.
Video Rebirth 쇼케이스 페이지의 HyperFlow 카메라 제어 예시.
HyperFlow란 무엇인가
HyperFlow는 **데이터 프리 플로우 자기 증류(data-free flow self-distillation)**로 얻어집니다. 모델이 자체적으로 후보 비디오를 생성하고, 품질을 기준으로 필터링한 뒤 통과한 후보로부터 증류합니다. 외부 데이터도, 사람이 만든 라벨도 필요하지 않습니다. Video Rebirth는 이를 자사 비디오 모델의 학습 패러다임인 RSI(Recursive Self-Improvement)의 자기 증류 구성 요소로 설명합니다.
중요한 구조적 선택: 베이스 가중치, 두 VAE, conditioner, 그리고 t2va, fl2va, ref2va 워크플로는 모두 공식 MiniMax H3 것을 그대로 유지합니다. 공개된 것은 LoRA뿐입니다.
| 속성 | 값 |
|---|---|
| 어댑터 형태 | PEFT LoRA, rank 256 / alpha 256 |
| 모듈 | 316개: 어텐션, 피드포워드 및 두 개의 time embedder |
| 크기 | 2.8 GB 단일 safetensors 파일 |
| 샘플링 | 파일에 저장된 고정 시그마 그리드에서 8회 포워드 패스 (video shift 12, audio shift 3) |
| 지원 범위 | t2va, fl2va, ref2va, 비디오와 오디오 동시 |
업스트림 구현은 공식 diffusers Modular Pipeline에서 실행되며, 병합된 모델 대신 로더와 예시 스크립트를 제공하므로 diffusers 0.40 이상과 함께 pip install "hyperflow-h3[examples] @ git+https://github.com/Video-Rebirth/hyperflow.git"가 필요합니다. HyperFlow는 최대 4개 GPU에 걸친 Ulysses 컨텍스트 병렬 처리와 NVIDIA의 Sol-Attn 희소 어텐션 커널도 지원합니다.
클립 전반의 일관성. Video Rebirth가 공개한 네 가지 쇼케이스 카테고리 중 하나입니다.
두 가지 ComfyUI 경로
이 LoRA는 ComfyUI의 LoRA 로더에 그대로 넣을 수 있는 파일이 아닙니다. 현재 이를 실행하는 방법은 두 가지입니다.
1. ComfyUI 내장 로더를 사용하는 커뮤니티 변환. 기여자 drbaph가 HyperFlow를 ComfyUI 키 레이아웃으로 변환했으며, 전체 및 pruned/curve-form H3 베이스를 커버하는 네 개의 파일이 있습니다:
| 파일 | 변형 |
|---|---|
minimax_h3_hyperflow_8step_v1.0_comfyui_bf16.safetensors | 전체 BF16 |
minimax_h3_hyperflow_8step_v1.0_comfyui_bf16_resized_avg_rank_20_bf16.safetensors | 리사이즈, 평균 rank 20 |
minimax_h3_hyperflow_8step_v1.0_comfyui_pruned_bf16.safetensors | pruned/curve-form 베이스용 |
minimax_h3_hyperflow_8step_v1.0_comfyui_pruned_bf16_resized_avg_rank_20_bf16.safetensors | pruned + 리사이즈 |
이 파일들은 ComfyUI 내장 MiniMax H3 LoRA 로더로 로드되며, 커스텀 노드가 필요하지 않습니다. 문서화된 설정은 8 스텝, LoRA 강도 1.0에서 시작, 그리고 euler / normal 또는 업스트림 수동 시그마 시퀀스입니다:
1.0, 0.931506, 0.839236, 0.703462, 0.5, 0.296538, 0.160764, 0.068494, 0.02. 엔드포인트 조건화를 재현하는 노드 팩. ComfyUI-HyperFlow는 단순 변환이 왜 동등하지 않은지 문서화합니다. HyperFlow는 LoRA만이 아닙니다. 각 스텝은 적분하는 구간 (t, r) (여기서 r = 1 - sigma_next)에 대해, 두 번째 LoRA가 적용된 time embedder를 통해 emb_t(t) + gate*(emb_r(r) - emb_t(t)) 형태로 조건화됩니다. ComfyUI의 샘플러는 r을 전달하지 않으므로, 이 팩은 엔드포인트 embedder를 구성하고 time_embedder.forward를 패치하여 비디오, 텍스트, 오디오 및 고정된 키프레임 행에 대해 행별 엔드포인트를 계산합니다. 또한 PEFT 파라미터 이름을 ComfyUI의 융합된 qkv_proj, mlp.fc1, proj_in/proj_out 타깃에 재매핑하고, 패치할 time embedder가 없는 곡선형 체크포인트는 거부합니다. 이 팩은 ComfyUI 자체 외에는 의존성이 없습니다.
재질과 디테일: 몇 스텝 H3 증류가 가장 먼저 잃기 쉬운 카테고리입니다.
독립적 교차 검증
가장 강력한 제3자 신호는 NVIDIA의 연구 저장소에 있습니다: NVlabs/Sana PR #507이 models/minimax_h3/HyperFlow/ 아래에 HyperFlow 8스텝 추론을 T2V, 첫 프레임 I2V, 그리고 동기화된 오디오가 있는 이미지 참조 Ref2VA용으로 추가했으며, 9월 19일에 병합되었습니다. 이 통합은 Video Rebirth의 정확한 커밋과 LoRA 리비전을 고정하고, HyperFlow의 two-time 조건화와 8스텝 스케줄을 유지하며, 별도의 transformer와 transformer_ref 가중치를 보존하고, Sol-H3 Ulysses, SOL/BSA 및 병렬 VAE 경로 위에 검증된 conditioner pruning과 함께 쌍을 이룬 AdaLN 사전 계산을 추가합니다. 초기 상주 프로필은 1344x768에서 8개의 B200 GPU를 대상으로 하며 5초, 10초, 15초 프리셋을 제공합니다.
초기 사용자 평가
HyperFlow는 출시 다음 날인 9월 18일 Banodoco의 #minimax_h3_chatter에 등장했고, 스레드는 "새로운 8 스텝 lora 출시"에서 기존 H3 Turbo LoRA와의 직접 비교로 빠르게 옮겨갔습니다.
- ComfyUI 변환을 수행한 drbaph는 장점을 "다른 turbo lora에 비해 h3 품질, 일관성/카메라 제어/디테일에 더 가깝다"고 설명하며, 업스트림이 제안한 대로 강도 1.0에서 테스트한다고 덧붙였습니다. 그가 8스텝 옵션 중 개인적으로 선호하는 것은 여전히 추출된 DMD VDN LoRA이며, HyperFlow와 "비슷하다"고 말합니다.
- 둘 다 테스트한 hacs2000은 "매우 좋다"고 평가했습니다.
- Stef는 수동 시그마 표를 놓치기 쉽다며, 사람들이 찾을 수 있는 곳에 문서화해야 한다고 지적했습니다.
실행 결과를 비교하기 전에 시그마 주의사항을 기억하세요: drbaph 변환은 고정 그리드를 수동 시그마로 노출하는 반면, 노드 팩은 엔드포인트를 네이티브로 계산하므로 두 경로가 바이트 단위로 동일하지는 않습니다.
균형 잡힌 기능, 네 번째 쇼케이스 카테고리입니다.
제공 현황
- 가중치: videorebirth/hyperflow (LoRA 및
hyperflow.json매니페스트) - 코드: Video-Rebirth/hyperflow (diffusers 로더와 예시 스크립트)
- 쇼케이스: videorebirth.com/lp/hyperflow
- ComfyUI 변환: drbaph/MiniMax-H3-Turbo-Lora-ComfyUI
- ComfyUI 노드 팩: Addis-Pulse-Studio/ComfyUI-HyperFlow
- NVIDIA 통합: NVlabs/Sana PR #507
HyperFlow가 다른 H3 가속들과 비교해 어디에 위치하는지는 H3 Acceleration Arena 블라인드 A/B 랭킹을 참고하고, 이전 독립형 Turbo 변환 워크플로는 VDN-H3 Turbo Standalone을 참고하세요.
댓글
GitHub로 로그인하고 토론에 참여하세요.