MiniMax H3 Turbo Ref2V v0.1: 4단계 레퍼런스 기반 비디오 생성 LoRA
Lightx2v와 ModelTC가 MiniMax H3 Turbo Ref2V v0.1을 출시했습니다. 다중 레퍼런스 비디오 생성을 위한 ComfyUI 호환 bf16 가중치가 포함된 4단계 레퍼런스 기반 비디오 생성 LoRA입니다.
Lightx2v 팀과 ModelTC는 8월 13일에 MiniMax H3 Turbo LoRA 라인의 레퍼런스 기반 비디오 생성 버전인 Ref2V Turbo v0.1을 출시했습니다. 8월 11일 FL2V Turbo v1.0 출시에 이어, 새 checkpoint는 동일한 4단계 증류를 Ref2VA(레퍼런스 기반 비디오 + 오디오 생성)에 적용하여 첫 프레임 하나 대신 하나 이상의 레퍼런스 이미지로 비디오를 생성할 수 있게 합니다.
Lightx2v Ref2V 테스트 에셋의 캐릭터 레퍼런스
v0.1 구성
| 모델 | 작업 | 학습 해상도 | 학습 시프트(비디오 / 오디오) | 증류 단계(NFE) | 권장 추론 단계 |
|---|---|---|---|---|---|
| Ref2VA Turbo 4단계 v0.1 | Ref2VA | 544p(혼합 AR) | 12 / 3 | 4 | 4 |
v0.1 릴리스는 Hugging Face의 두 파일로 구성됩니다:
minimax_h3_ref2v_turbo_4step_v0.1_bf16.safetensors: Diffusers용minimax_h3_ref2v_turbo_4step_v0.1_comfyui_bf16.safetensors: 변환 없이 ComfyUI에 바로 사용 가능
레퍼런스 이미지 크기 조정 정책의 경우, 프로젝트는 증류 학습 중 사용된 match 모드를 권장합니다. 이 모드는 레퍼런스의 종횡비를 유지하면서 레퍼런스 픽셀 영역을 대상 캔버스에 맞추며, 더 작은 레퍼런스를 업스케일링하지 않습니다. 지원되는 세 가지 정책 모두 레퍼런스 종횡비를 유지하고 H3 해상도 그리드(크기를 32의 배수로 반올림)를 사용하며 레퍼런스 콘텐츠를 자르지 않습니다.
ComfyUI 사용 방법
MiniMax H3는 ComfyUI를 기본 지원하므로 LoRA에 커스텀 노드가 필요하지 않습니다:
minimax_h3_ref2v_turbo_4step_v0.1_comfyui_bf16.safetensors를ComfyUI/models/loras/에 다운로드합니다.- Ref2V 워크플로에서 기본 MiniMax H3 checkpoint를 로드하고 모델 로더와 샘플러 사이에 LoRA를 적용합니다.
- 레퍼런스 입력 브랜치를 통해 하나 이상의 레퍼런스 이미지를 연결하고 4단계 샘플링을 실행합니다.
공식 MiniMax H3 R2V 워크플로 템플릿이 좋은 시작점입니다. 프로젝트는 또한 960x544(16:9, 0.5 MP)에서 Ref2VA Turbo 4단계 v0.1 checkpoint를 기본값으로 사용하는 전용 예제 그래프인 video_minimax_h3_ref2v_lightx2v_turbo.json을 제공합니다.
제공 정보
- 가중치: Hugging Face의 lightx2v/Minimax-h3-Turbo(bf16 Diffusers 및 ComfyUI 형식)
- 코드 및 워크플로: GitHub의 ModelTC/Minimax-H3-Turbo
- 공식 ComfyUI 템플릿: Comfy-Org/workflow_templates의 video_minimax_h3_r2v
댓글
GitHub로 로그인하고 토론에 참여하세요.