MiniMax H3 커뮤니티 양자화 모델: 소비자 GPU용 GGUF, INT4, NVFP4
ComfyUI용 MiniMax H3 커뮤니티 양자화 모델 다운로드: GGUF Q2-Q5(MiniMax-H3-FL2VA-Q3_K_M/Q4_K_M, 텍스트 인코더 GGUF), 프루닝 INT4/INT8, NVFP4 파일과 번들 워크플로우.
MiniMax H3의 커뮤니티 양자화 모델이 오픈 가중치 공개 다음 날부터 Hugging Face에 등장하기 시작하며, 33.1B 옴니모달 비디오 모델을 소비자 GPU에 맞는 크기로 압축했습니다. 8월 3일에 총 4개의 저장소가 공개되었습니다. GGUF Q2-Q5, 프루닝된 INT4/INT8, NVFP4 포맷을 다루며, 대부분 번들 ComfyUI 워크플로를 포함합니다.
오픈 가중치 공개 자체는 8월 3일에 네이티브 ComfyUI 지원과 함께 이루어졌습니다 (오픈 가중치 관련 글 읽기). 공식 Comfy-Org 리패키지에는 bf16, INT8, 프루닝된 INT8 파일이 포함되어 있지만, 커뮤니티 양자화 물결은 더 나아갑니다. ComfyUI의 GGUF 로더와 호환되는 GGUF 가중치, 약 11-12 GB 크기의 INT4 파일, Blackwell GPU용 NVFP4 변형까지 제공합니다.
Abiray의 MiniMax-H3-GGUF 저장소에 포함된 샘플 비디오의 한 프레임
공개된 내용
| 저장소 | 포맷 | 주요 사항 |
|---|---|---|
| Abiray/MiniMax-H3-GGUF | GGUF | Q3_K_M/S, Q4_0, Q4_K_M/S, Q5_0, Q5_K_M/S 포맷의 FL2VA + Ref2VA (15.6-23.9 GB), GGUF/INT4/NVFP4 텍스트 인코더, 번들 FL2V 워크플로 |
| realrebelai/MiniMax-H3_GGUFs | GGUF | Q2_K 혼합 정밀도, Q3_K_M, Q4_K_M 포맷의 FL2VA + Ref2VA, Q2_K 및 Q4_K_M 텍스트 인코더 GGUF, FL2V/Ref2V 워크플로 |
| Abiray/Minimax-H3-nvfp4-INT4-INT8-Convrot | INT4 / INT8 / NVFP4 | 프루닝된 INT4 (~11.3 GB), 혼합 INT4/INT8 (~15.5 GB), INT8 (~21 GB), NVFP4 (12.5 GB), GPU별 선택 가이드 포함 |
| lilcheaty/MiniMax-H3-NVFP4 | NVFP4 | ComfyUI 프로필 JSON이 포함된 FL2VA 및 Ref2VA NVFP4 프루닝/풀/혼합 변형 |
GPU에 H3 맞추기
양자화 저장소들은 사용자의 GPU에 맞춰 파일을 구성합니다:
| GPU | 권장 파일 |
|---|---|
| 16 GB VRAM (RTX 4070 Ti Super, RTX 4080) | GGUF Q3/Q4 또는 프루닝된 INT4 / 혼합 INT4/INT8 diffusion 모델 + INT4 텍스트 인코더 |
| 24 GB VRAM (RTX 3090, RTX 4090) | GGUF Q5 또는 프루닝된 INT8 diffusion 모델 + INT8 텍스트 인코더 |
| Blackwell (RTX 5090, PRO 6000) | NVFP4 프루닝 diffusion 모델 + NVFP4 AWQ 텍스트 인코더 |
어떤 구성을 선택하든 여전히 두 VAE가 모두 필요합니다: minimax_h3_video_vae_fp16.safetensors 및 minimax_h3_audio_vae_fp32.safetensors.
샘플 출력
MiniMax-H3-GGUF 저장소에 포함된 샘플 비디오
ComfyUI 워크플로
GGUF 저장소들은 바로 사용할 수 있는 워크플로를 제공합니다. Abiray의 저장소에는 양자화된 FL2VA 모델을 사용한 텍스트 기반 비디오 생성을 위한 minimax_fl2v_gguf_workflow.json이 포함되어 있습니다:
Comfy-Org의 공식 bf16/INT8 워크플로는 오픈 가중치 관련 글 또는 내장 템플릿 갤러리(video_minimax_h3_t2v, video_minimax_h3_i2v, video_minimax_h3_r2v)에서 확인할 수 있습니다.
다운로드
- Abiray/MiniMax-H3-GGUF: Hugging Face, FL2VA 및 Ref2VA용 GGUF Q3-Q5
- realrebelai/MiniMax-H3_GGUFs: Hugging Face, 워크플로가 포함된 GGUF Q2-Q4
- Abiray/Minimax-H3-nvfp4-INT4-INT8-Convrot: Hugging Face, 프루닝된 INT4/INT8/NVFP4
- lilcheaty/MiniMax-H3-NVFP4: Hugging Face, NVFP4 변형
댓글
GitHub로 로그인하고 토론에 참여하세요.