MiniMax H3 커뮤니티 양자화 모델: 소비자 GPU용 GGUF, INT4, NVFP4
MiniMax H3의 커뮤니티 양자화 모델이 오픈 가중치 공개 다음 날 Hugging Face에 등장했습니다. GGUF Q2-Q5, 프루닝된 INT4/INT8, NVFP4 파일과 번들 ComfyUI 워크플로가 제공됩니다.
MiniMax H3의 커뮤니티 양자화 모델이 오픈 가중치 공개 다음 날부터 Hugging Face에 등장하기 시작하며, 33.1B 옴니모달 비디오 모델을 소비자 GPU에 맞는 크기로 압축했습니다. 8월 3일에 총 4개의 저장소가 공개되었습니다. GGUF Q2-Q5, 프루닝된 INT4/INT8, NVFP4 포맷을 다루며, 대부분 번들 ComfyUI 워크플로를 포함합니다.
오픈 가중치 공개 자체는 8월 3일에 네이티브 ComfyUI 지원과 함께 이루어졌습니다 (오픈 가중치 관련 글 읽기). 공식 Comfy-Org 리패키지에는 bf16, INT8, 프루닝된 INT8 파일이 포함되어 있지만, 커뮤니티 양자화 물결은 더 나아갑니다. ComfyUI의 GGUF 로더와 호환되는 GGUF 가중치, 약 11-12 GB 크기의 INT4 파일, Blackwell GPU용 NVFP4 변형까지 제공합니다.
Abiray의 MiniMax-H3-GGUF 저장소에 포함된 샘플 비디오의 한 프레임
공개된 내용
| 저장소 | 포맷 | 주요 사항 |
|---|---|---|
| Abiray/MiniMax-H3-GGUF | GGUF | Q3_K_M/S, Q4_0, Q4_K_M/S, Q5_0, Q5_K_M/S 포맷의 FL2VA + Ref2VA (15.6-23.9 GB), GGUF/INT4/NVFP4 텍스트 인코더, 번들 FL2V 워크플로 |
| realrebelai/MiniMax-H3_GGUFs | GGUF | Q2_K 혼합 정밀도, Q3_K_M, Q4_K_M 포맷의 FL2VA + Ref2VA, Q2_K 및 Q4_K_M 텍스트 인코더 GGUF, FL2V/Ref2V 워크플로 |
| Abiray/Minimax-H3-nvfp4-INT4-INT8-Convrot | INT4 / INT8 / NVFP4 | 프루닝된 INT4 (~11.3 GB), 혼합 INT4/INT8 (~15.5 GB), INT8 (~21 GB), NVFP4 (12.5 GB), GPU별 선택 가이드 포함 |
| lilcheaty/MiniMax-H3-NVFP4 | NVFP4 | ComfyUI 프로필 JSON이 포함된 FL2VA 및 Ref2VA NVFP4 프루닝/풀/혼합 변형 |
GPU에 H3 맞추기
양자화 저장소들은 사용자의 GPU에 맞춰 파일을 구성합니다:
| GPU | 권장 파일 |
|---|---|
| 16 GB VRAM (RTX 4070 Ti Super, RTX 4080) | GGUF Q3/Q4 또는 프루닝된 INT4 / 혼합 INT4/INT8 diffusion 모델 + INT4 텍스트 인코더 |
| 24 GB VRAM (RTX 3090, RTX 4090) | GGUF Q5 또는 프루닝된 INT8 diffusion 모델 + INT8 텍스트 인코더 |
| Blackwell (RTX 5090, PRO 6000) | NVFP4 프루닝 diffusion 모델 + NVFP4 AWQ 텍스트 인코더 |
어떤 구성을 선택하든 여전히 두 VAE가 모두 필요합니다: minimax_h3_video_vae_fp16.safetensors 및 minimax_h3_audio_vae_fp32.safetensors.
샘플 출력
MiniMax-H3-GGUF 저장소에 포함된 샘플 비디오
ComfyUI 워크플로
GGUF 저장소들은 바로 사용할 수 있는 워크플로를 제공합니다. Abiray의 저장소에는 양자화된 FL2VA 모델을 사용한 텍스트 기반 비디오 생성을 위한 minimax_fl2v_gguf_workflow.json이 포함되어 있습니다:
Comfy-Org의 공식 bf16/INT8 워크플로는 오픈 가중치 관련 글 또는 내장 템플릿 갤러리(video_minimax_h3_t2v, video_minimax_h3_i2v, video_minimax_h3_r2v)에서 확인할 수 있습니다.
다운로드
- Abiray/MiniMax-H3-GGUF: Hugging Face, FL2VA 및 Ref2VA용 GGUF Q3-Q5
- realrebelai/MiniMax-H3_GGUFs: Hugging Face, 워크플로가 포함된 GGUF Q2-Q4
- Abiray/Minimax-H3-nvfp4-INT4-INT8-Convrot: Hugging Face, 프루닝된 INT4/INT8/NVFP4
- lilcheaty/MiniMax-H3-NVFP4: Hugging Face, NVFP4 변형
댓글
GitHub로 로그인하고 토론에 참여하세요.