MiniMax H3 Turbo-SLA: ComfyUI용 4스텝 FL2V 희소 어텐션 LoRA

ComfyUI Wikinews

Lightx2v가 MiniMax H3 Turbo-SLA를 공개했습니다. 85% 희소 어텐션을 적용한 4스텝 FL2V 증류 LoRA로, RTX 5090에서 약 2.5배 빠르며 LightX2V 및 ComfyUI 형식을 제공합니다.

Lightx2v 팀이 MiniMax H3용 4스텝 증류 첫/마지막 프레임-투-비디오(FL2V) 체크포인트인 MiniMax H3 Turbo-SLA를 공개했습니다. 빠른 증류와 SLA(Sparse-Linear Attention)를 결합해 더 효율적인 추론을 구현합니다(Hugging Face).

MiniMax H3 Turbo-SLA 나란히 비교 데모

30스텝 MiniMax H3 기본 모델과 4스텝 Turbo-SLA 모델의 나란히 비교

이 모델은 85% 어텐션 희소 비율을 사용합니다. 테스트한 LightX2V 환경에서 NVIDIA RTX 5090 기준 약 2.5배 추론 가속을 제공하면서 경쟁력 있는 화질을 유지하며, 768p FL2V 생성을 지원합니다.

Your browser does not support the video tag.

릴리스 내용

리포지토리에는 동일한 4스텝 FL2V LoRA의 BF16 체크포인트 2개가 포함되어 있습니다.

체크포인트형식설명
minimax_h3_fl2v_turbo_4step_v0.1_768p_sla_bf16.safetensorsLightX2VLightX2V 추론용 네이티브 BF16 LoRA 체크포인트
minimax_h3_fl2v_turbo_4step_v0.1_768p_sla_comfyui_bf16.safetensorsComfyUIComfyUI 워크플로용으로 변환된 BF16 LoRA 체크포인트

두 체크포인트 모두 원본 MiniMax-H3 모델 가중치가 필요합니다. LightX2V 추론 경로는 전용 SLA 설정(attn_type: dynamic_sparse_attn, sage2 연산자 기반 85% 희소 비율, 비디오/오디오 플로우 시프트 6.0/3.0)을 사용합니다.

ComfyUI 사용법

MiniMax H3는 ComfyUI를 네이티브 지원하므로 LoRA에 커스텀 노드가 필요하지 않습니다.

  1. minimax_h3_fl2v_turbo_4step_v0.1_768p_sla_comfyui_bf16.safetensorsComfyUI/models/loras/에 다운로드합니다.
  2. FL2V 워크플로에서 MiniMax H3 기본 체크포인트를 로드하고 모델 로더와 샘플러 사이에 LoRA를 적용합니다.
  3. 768p 해상도(예: 1344x768)에서 4스텝 샘플링을 실행합니다.

이번 릴리스는 Lightx2v Turbo 시리즈의 후속작입니다. 이전 4스텝 v0.1v1.0 8스텝/768p 체크포인트는 계속 사용할 수 있으며, SLA 변형은 4스텝 증류 위에 추가 속도를 원하는 사용자를 위한 희소 어텐션 경로를 제공합니다.

댓글

GitHub로 로그인하고 토론에 참여하세요.

댓글을 불러오는 중…
MiniMax H3 Turbo-SLA: ComfyUI용 4스텝 FL2V 희소 어텐션 LoRA | ComfyUI Wiki