MiniMax H3 Turbo Ref2VA 8 단계 v1.0: 레퍼런스 기반 비디오 생성 LoRA
minimax_h3_ref2v_turbo_8step_v1.0_comfyui_bf16.safetensors 다운로드: 오디오 지원 MiniMax H3용 Lightx2v의 8 단계 768p Ref2VA 증류 및 업데이트된 예시 워크플로 포함.
Lightx2v 팀과 ModelTC가 Minimax-h3-Turbo 를 Ref2VA Turbo 8 단계 v1.0 768p로 업데이트했습니다. 이는 레퍼런스 기반 비디오 경로의 8 단계 768p 증류 버전으로, 하나 이상의 레퍼런스 이미지가 베이스 모델의 스텝 수보다 훨씬 적은 수로 오디오가 포함된 생성 비디오를 구동합니다 (릴리스 리포지토리).
이는 Turbo 라인업의 마지막 공백을 메웁니다. FL2VA 쪽은 이미 v1.0 릴리스 이후 8 단계와 768p 체크포인트를 보유하고 있었으며, Ref2VA 는 544p 의 4 단계 v0.1 만 있었습니다.
모델 사양
모델 사양 표 에는 이제 FL2VA 와 Ref2VA 를 아우르는 여섯 개의 체크포인트가 나열되어 있습니다. 새로운 항목:
| 모델 | 작업 | 학습 해상도 | 학습 시프트 (비디오 / 오디오) | 증류 스텝 (NFE) | 권장 추론 스텝 |
|---|---|---|---|---|---|
| Ref2VA Turbo 8 단계 v1.0 768p | Ref2VA | 768p (1344x768) | 6 / 3 | 8 | 8 |
두 개의 파일이 Hugging Face 에서 제공됩니다:
minimax_h3_ref2v_turbo_8step_v1.0_768p_bf16.safetensors(Diffusers 용)minimax_h3_ref2v_turbo_8step_v1.0_768p_comfyui_bf16.safetensors(ComfyUI 준비 완료, 변환 불필요)
LightX2V Studio 는 현재 FL2VA Turbo 8 단계 v1.0 768p LoRA 를 제공하며, 같은 리포지토리는 이제 8 단계와 768p 에서 Ref2VA 경로도 커버합니다.
ComfyUI 사용법
MiniMax H3 는 네이티브 ComfyUI 지원을 제공하므로 LoRA 에 커스텀 노드가 필수가 아닙니다:
minimax_h3_ref2v_turbo_8step_v1.0_768p_comfyui_bf16.safetensors를ComfyUI/models/loras/로 다운로드합니다.- Ref2V 워크플로에서 베이스 MiniMax H3 체크포인트를 로드하고 모델 로더와 샘플러 사이에 LoRA 를 적용합니다.
- 하나 이상의 레퍼런스 이미지를 레퍼런스 입력 브랜치를 통해 연결하고 768p(예: 1344x768) 에서 8 회 샘플링 단계를 실행합니다.
공식 MiniMax H3 R2V 워크플로 템플릿 은 좋은 시작점입니다. 프로젝트 자체의 예시 그래프도 최신 상태입니다: video_minimax_h3_ref2v_lightx2v_turbo.json 은 기본적으로 Ref2VA Turbo 4 단계 v0.1 체크포인트를 사용하고, T2VA/I2VA 그래프는 FL2VA Turbo 8 단계 v1.0 을 기본값으로 합니다.
레퍼런스 이미지 크기 조정의 경우, 프로젝트는 증류 학습 중 사용된 match 모드를 권장하며, 이는 추론 진입점에서 --reference-resize-mode 를 통해 노출됩니다.
가용성
- 가중치: Hugging Face 의 lightx2v/Minimax-h3-Turbo (Apache-2.0), bf16 Diffusers 및 ComfyUI 포맷
- 코드 및 워크플로: GitHub 의 ModelTC/Minimax-H3-Turbo
- 호스팅: LightX2V Studio 및 LightX2V API 에서 클라우드에서 Turbo 라인업을 실행합니다.
댓글
GitHub로 로그인하고 토론에 참여하세요.