MiniMax H3 Turbo-SLA: LoRA FL2V de 4 pasos para ComfyUI
Lightx2v lanza MiniMax H3 Turbo-SLA, una destilación FL2V de 4 pasos con atención dispersa al 85%, unas 2.5 veces más rápida en RTX 5090, en formatos LightX2V y ComfyUI.
El equipo de Lightx2v ha lanzado MiniMax H3 Turbo-SLA, un checkpoint destilado de 4 pasos de primer/último fotograma a vídeo (FL2V) para MiniMax H3 que combina destilación rápida con SLA (Sparse-Linear Attention) para una inferencia más eficiente (Hugging Face).
Comparación lado a lado entre el modelo base MiniMax H3 de 30 pasos y el modelo Turbo-SLA de 4 pasos
El modelo usa una tasa de dispersión de atención del 85%. En la configuración LightX2V probada ofrece aproximadamente 2.5 veces más aceleración de inferencia en una NVIDIA RTX 5090 manteniendo una calidad visual competitiva, y soporta generación FL2V a 768p.
Qué incluye el lanzamiento
El repositorio incluye dos checkpoints BF16 del mismo LoRA FL2V de 4 pasos:
| Checkpoint | Formato | Descripción |
|---|---|---|
minimax_h3_fl2v_turbo_4step_v0.1_768p_sla_bf16.safetensors | LightX2V | Checkpoint LoRA BF16 nativo para inferencia con LightX2V |
minimax_h3_fl2v_turbo_4step_v0.1_768p_sla_comfyui_bf16.safetensors | ComfyUI | Checkpoint LoRA BF16 convertido para flujos de ComfyUI |
Ambos checkpoints requieren los pesos del modelo MiniMax-H3 original. La ruta de inferencia LightX2V usa una configuración SLA dedicada con attn_type: dynamic_sparse_attn, una tasa de dispersión del 85% con el operador sage2, y desplazamientos de flujo de vídeo/audio de 6.0/3.0.
Uso en ComfyUI
MiniMax H3 tiene soporte nativo en ComfyUI, por lo que el LoRA no requiere nodos personalizados:
- Descarga
minimax_h3_fl2v_turbo_4step_v0.1_768p_sla_comfyui_bf16.safetensorsenComfyUI/models/loras/. - Carga el checkpoint base de MiniMax H3 en un flujo FL2V y aplica el LoRA entre el cargador de modelo y el muestreador.
- Ejecuta 4 pasos de muestreo a resolución 768p (por ejemplo 1344x768).
Este lanzamiento continúa la línea Turbo de Lightx2v: los anteriores v0.1 de 4 pasos y v1.0 de 8 pasos / 768p siguen disponibles, y la variante SLA añade una ruta de atención dispersa para quienes quieren más velocidad además de la destilación de 4 pasos.
Comentarios
Inicia sesión con GitHub para unirte a la conversación.