MiniMax H3 Turbo-SLA: ComfyUI용 4스텝 FL2V 희소 어텐션 LoRA
Lightx2v가 MiniMax H3 Turbo-SLA를 공개했습니다. 85% 희소 어텐션을 적용한 4스텝 FL2V 증류 LoRA로, RTX 5090에서 약 2.5배 빠르며 LightX2V 및 ComfyUI 형식을 제공합니다.
Lightx2v 팀이 MiniMax H3용 4스텝 증류 첫/마지막 프레임-투-비디오(FL2V) 체크포인트인 MiniMax H3 Turbo-SLA를 공개했습니다. 빠른 증류와 SLA(Sparse-Linear Attention)를 결합해 더 효율적인 추론을 구현합니다(Hugging Face).
30스텝 MiniMax H3 기본 모델과 4스텝 Turbo-SLA 모델의 나란히 비교
이 모델은 85% 어텐션 희소 비율을 사용합니다. 테스트한 LightX2V 환경에서 NVIDIA RTX 5090 기준 약 2.5배 추론 가속을 제공하면서 경쟁력 있는 화질을 유지하며, 768p FL2V 생성을 지원합니다.
릴리스 내용
리포지토리에는 동일한 4스텝 FL2V LoRA의 BF16 체크포인트 2개가 포함되어 있습니다.
| 체크포인트 | 형식 | 설명 |
|---|---|---|
minimax_h3_fl2v_turbo_4step_v0.1_768p_sla_bf16.safetensors | LightX2V | LightX2V 추론용 네이티브 BF16 LoRA 체크포인트 |
minimax_h3_fl2v_turbo_4step_v0.1_768p_sla_comfyui_bf16.safetensors | ComfyUI | ComfyUI 워크플로용으로 변환된 BF16 LoRA 체크포인트 |
두 체크포인트 모두 원본 MiniMax-H3 모델 가중치가 필요합니다. LightX2V 추론 경로는 전용 SLA 설정(attn_type: dynamic_sparse_attn, sage2 연산자 기반 85% 희소 비율, 비디오/오디오 플로우 시프트 6.0/3.0)을 사용합니다.
ComfyUI 사용법
MiniMax H3는 ComfyUI를 네이티브 지원하므로 LoRA에 커스텀 노드가 필요하지 않습니다.
minimax_h3_fl2v_turbo_4step_v0.1_768p_sla_comfyui_bf16.safetensors를ComfyUI/models/loras/에 다운로드합니다.- FL2V 워크플로에서 MiniMax H3 기본 체크포인트를 로드하고 모델 로더와 샘플러 사이에 LoRA를 적용합니다.
- 768p 해상도(예: 1344x768)에서 4스텝 샘플링을 실행합니다.
이번 릴리스는 Lightx2v Turbo 시리즈의 후속작입니다. 이전 4스텝 v0.1 및 v1.0 8스텝/768p 체크포인트는 계속 사용할 수 있으며, SLA 변형은 4스텝 증류 위에 추가 속도를 원하는 사용자를 위한 희소 어텐션 경로를 제공합니다.
댓글
GitHub로 로그인하고 토론에 참여하세요.