MiniMax H3 Turbo Ref2VA 8-Step v1.0: LoRA de Referencia a Vídeo
Descargar minimax_h3_ref2v_turbo_8step_v1.0_comfyui_bf16.safetensors: destilación Ref2VA de 8 pasos y 768p de Lightx2v para MiniMax H3, con audio y ejemplos.
El equipo de Lightx2v y ModelTC actualizaron Minimax-h3-Turbo con Ref2VA Turbo 8-step v1.0 768p, una distilación de 8 pasos y 768p del camino de referencia a vídeo: una o más imágenes de referencia impulsan un vídeo generado con audio, en una fracción del conteo de pasos del modelo base (repo de lanzamiento).
Esto llena el último hueco en la línea Turbo. El lado FL2VA ya tenía checkpoints de 8 pasos y 768p desde el lanzamiento v1.0, mientras que Ref2VA solo tenía el v0.1 de 4 pasos a 544p.
Especificaciones del modelo
La tabla de especificaciones del modelo ahora lista seis checkpoints entre FL2VA y Ref2VA. La nueva entrada:
| Modelo | Tareas | Resolución de entrenamiento | Desplazamientos de entrenamiento (vídeo / audio) | Pasos de distilación (NFE) | Pasos de inferencia recomendados |
|---|---|---|---|---|---|
| Ref2VA Turbo 8-step v1.0 768p | Ref2VA | 768p (1344x768) | 6 / 3 | 8 | 8 |
Dos archivos se envían para ello en Hugging Face:
minimax_h3_ref2v_turbo_8step_v1.0_768p_bf16.safetensorspara Diffusersminimax_h3_ref2v_turbo_8step_v1.0_768p_comfyui_bf16.safetensorslisto para ComfyUI, sin conversión necesaria
LightX2V Studio actualmente sirve el LoRA FL2VA Turbo 8-step v1.0 768p; el mismo repositorio ahora cubre el camino Ref2VA a 8 pasos y 768p.
Uso en ComfyUI
MiniMax H3 tiene soporte nativo de ComfyUI, por lo que no se requiere ningún nodo personalizado para el LoRA:
- Descargar
minimax_h3_ref2v_turbo_8step_v1.0_768p_comfyui_bf16.safetensorsenComfyUI/models/loras/. - Cargar el checkpoint base de MiniMax H3 en un flujo de trabajo Ref2V y aplicar el LoRA entre el cargador de modelo y el sampler.
- Conectar una o más imágenes de referencia a través de la rama de entrada de referencia y ejecutar 8 pasos de muestreo a 768p (por ejemplo 1344x768).
La oficial plantilla de flujo de trabajo MiniMax H3 R2V es un buen punto de partida. Los gráficos de ejemplo propios del proyecto también están actualizados: video_minimax_h3_ref2v_lightx2v_turbo.json usa por defecto el checkpoint Ref2VA Turbo 4-step v0.1, y los gráficos T2VA/I2VA usan por defecto el FL2VA Turbo 8-step v1.0.
Para el tamaño de las imágenes de referencia, el proyecto recomienda el modo match utilizado durante el entrenamiento de distilación, expuesto a través de --reference-resize-mode en su punto de entrada de inferencia.
Disponibilidad
- Pesos: lightx2v/Minimax-h3-Turbo en Hugging Face (Apache-2.0), formatos bf16 Diffusers y ComfyUI
- Código y flujos de trabajo: ModelTC/Minimax-H3-Turbo en GitHub
- Alojado: LightX2V Studio y la API de LightX2V ejecutan la línea Turbo en la nube
Comentarios
Inicia sesión con GitHub para unirte a la conversación.