MiniMax H3 Turbo LoRA: Destilación FL2V de 4 pasos para ComfyUI
Lightx2v y ModelTC destilan MiniMax H3 en un Turbo LoRA FL2V de 4 pasos, reduciendo el muestreo de ~20 pasos a 4 con una conversión para ComfyUI y Spaces de demostración.
El equipo de Lightx2v y ModelTC lanzaron un Turbo LoRA de 4 pasos para MiniMax H3, destilando la generación de primer y último fotograma a vídeo (FL2V) del modelo de vídeo, reduciéndola de aproximadamente 20 pasos de muestreo a solo 4 (Hugging Face, GitHub). El LoRA, de aproximadamente 1.3 GB, es una vista previa temprana: la v0.1 se centra en la calidad FL2V, con una destilación Ref2V ya en la hoja de ruta.
Un fotograma de la salida de ejemplo del autor con 4 pasos
Qué incluye el lanzamiento
- Pesos:
minimax_h3_fl2v_turbo_4step_v0.1.safetensorsen Hugging Face, destilado del modelo base MiniMax-H3 - Código de inferencia: el repositorio de ModelTC proporciona inferencia MiniMax-H3 por lotes, además de comparaciones NFE/LoRA contra el modelo base a 50 NFE
- Spaces de demostración: el Space MiniMax-H3-Turbo-Lora de akhaliq y un Space de la organización oficial te permiten probar el LoRA sin hardware local
- Hoja de ruta: mejorar los detalles visuales de FL2V y la calidad general, y luego desarrollar una destilación basada en Ref2V
Las notas de la versión etiquetan la v0.1 como una vista previa: los detalles visuales aún necesitan mejoras y una versión actualizada está en desarrollo.
Uso en ComfyUI
ComfyUI no necesita un nodo personalizado para este LoRA. Kijai publicó una conversión compatible con ComfyUI en Kijai/MiniMax-H3_comfy (minimax_h3_fl2v_lightx2v_turbo_4step_v0.1_comfy.safetensors, además de una variante bf16 redimensionada) apenas una hora después del lanzamiento. Coloca el archivo en models/loras/, carga el checkpoint H3 base y aplica el LoRA con una intensidad de 0.75 y 4 pasos usando un muestreador er_sde o sa_solver, según las notas de prueba de Kijai.
La plantilla de flujo de trabajo oficial de texto a vídeo de MiniMax H3 es un buen punto de partida; inserta el Turbo LoRA entre el cargador de modelos y el muestreador y cambia a las configuraciones de 4 pasos mencionadas anteriormente.
Nota: los autores observaron algunas diferencias entre los resultados de inferencia de Diffusers y ComfyUI (el audio sonaba más natural en Diffusers). Un error de audio en la ruta de ComfyUI se corrigió en una actualización nocturna. Para reproducir resultados que coincidan con los del artículo, sigue el script de inferencia de ModelTC.
Salida de ejemplo compartida por los autores en la discusión del lanzamiento
Disponibilidad
- Pesos: lightx2v/Minimax-h3-Turbo en Hugging Face
- Código: ModelTC/Minimax-H3-Turbo en GitHub
- Conversión para ComfyUI: Kijai/MiniMax-H3_comfy
- Demo: Space MiniMax-H3-Turbo-Lora
Comentarios
Inicia sesión con GitHub para unirte a la conversación.