MiniMax H3 Turbo LoRA v1.0: pesos FL2V de 8 pasos y 768p para ComfyUI
Lightx2v y ModelTC lanzan MiniMax H3 Turbo LoRA v1.0 con un checkpoint FL2V de 8 pasos y una variante de 4 pasos a 768p, ambos con pesos bf16 listos para ComfyUI.
El 11 de agosto, el equipo de Lightx2v y ModelTC lanzaron la v1.0 de su MiniMax H3 Turbo LoRA, tras la vista previa v0.1 del 7 de agosto. La actualización añade dos nuevos checkpoints FL2VA en bf16, cada uno con un formato listo para ComfyUI, incluida una variante entrenada a mayor resolución.
Ejemplo de fotograma de la salida de demostración del proyecto Turbo LoRA de Lightx2v
Qué incluye la v1.0
| Modelo | Tareas | Resolución de entrenamiento | Pasos de destilación | Inferencia recomendada |
|---|---|---|---|---|
| FL2VA Turbo 4-step v0.1 | FL2VA / T2VA | 544p (AR mixta) | 4 | 4 |
| FL2VA Turbo 8-step v1.0 | FL2VA / T2VA | 544p (AR mixta) | 8 | 8 o 4 |
| FL2VA Turbo 4-step v1.0 768p | FL2VA / T2VA | 768p (1344x768) | 4 | 4 |
La versión v1.0 consta de dos nuevos checkpoints en Hugging Face:
- 8-step v1.0 (
minimax_h3_fl2v_turbo_8step_v1.0_bf16.safetensors): destilado a 8 NFE con desplazamientos de vídeo/audio de 12/3, y utilizable en 8 o 4 pasos de inferencia. - 4-step v1.0 768p (
minimax_h3_fl2v_turbo_4step_v1.0_768p_bf16.safetensors): una destilación de 4 pasos entrenada a 768p (1344x768) con desplazamientos de 6/3, orientada a la generación de vídeo a mayor resolución a partir del primer/último fotograma.
Cada checkpoint tiene una versión gemela en formato ComfyUI (..._comfyui_bf16.safetensors) alojada en el mismo repositorio, por lo que no se necesita ninguna conversión adicional.
Uso en ComfyUI
MiniMax H3 tiene soporte nativo de ComfyUI, por lo que no se requiere ningún nodo personalizado para el LoRA:
- Descarga el archivo en formato ComfyUI (por ejemplo,
minimax_h3_fl2v_turbo_8step_v1.0_comfyui_bf16.safetensors) enComfyUI/models/loras/. - Carga el checkpoint base MiniMax H3 en un flujo de trabajo FL2VA y aplica el LoRA entre el cargador de modelos y el muestreador.
- Para el checkpoint de 8 pasos, ejecuta 8 pasos de muestreo (4 también funciona); para la variante de 768p, ejecuta 4 pasos a resolución 768p.
La plantilla oficial de flujo de trabajo de imagen a vídeo de MiniMax H3 es un buen punto de partida: inserta el Turbo LoRA entre el cargador de modelos y el muestreador, y cambia a las configuraciones de pasos indicadas arriba.
Disponibilidad
- Pesos: lightx2v/Minimax-h3-Turbo en Hugging Face (formatos diffusers y ComfyUI en bf16)
- Código: ModelTC/Minimax-H3-Turbo en GitHub, con un script de inferencia por lotes y comparaciones de NFE/LoRA
Comentarios
Inicia sesión con GitHub para unirte a la conversación.