MiniMax H3 Turbo Ref2VA 8-Étapes v1.0 : LoRA Référence-vers-Vidéo
Télécharger minimax_h3_ref2v_turbo_8step_v1.0_comfyui_bf16.safetensors : distillation Ref2VA 8 étapes 768p de Lightx2v pour MiniMax H3, avec audio et exemples.
L'équipe Lightx2v et ModelTC ont mis à jour Minimax-h3-Turbo avec Ref2VA Turbo 8-étapes v1.0 768p, une distillation 8-étapes 768p du chemin référence-vers-vidéo : une ou plusieurs images de référence pilotent une vidéo générée avec audio, à une fraction du nombre d'étapes du modèle de base (dépôt de sortie).
Cela comble la dernière lacune dans la gamme Turbo. Le côté FL2VA avait déjà des checkpoints 8-étapes et 768p depuis la sortie v1.0, tandis que Ref2VA n'avait que le 4-étapes v0.1 à 544p.
Spécifications du modèle
Le tableau des spécifications du modèle liste maintenant six checkpoints à travers FL2VA et Ref2VA. La nouvelle entrée :
| Modèle | Tâches | Résolution d'entraînement | Décalages d'entraînement (vidéo / audio) | Étapes de distillation (NFE) | Étapes d'inférence recommandées |
|---|---|---|---|---|---|
| Ref2VA Turbo 8-étapes v1.0 768p | Ref2VA | 768p (1344x768) | 6 / 3 | 8 | 8 |
Deux fichiers sont disponibles pour ce modèle sur Hugging Face :
minimax_h3_ref2v_turbo_8step_v1.0_768p_bf16.safetensorspour Diffusersminimax_h3_ref2v_turbo_8step_v1.0_768p_comfyui_bf16.safetensorsprêt pour ComfyUI, aucune conversion nécessaire
Le Studio LightX2V sert actuellement le LoRA FL2VA Turbo 8-étapes v1.0 768p ; le même dépôt couvre désormais le chemin Ref2VA à 8 étapes et 768p.
Utilisation ComfyUI
MiniMax H3 dispose d'un support natif ComfyUI, donc aucun nœud personnalisé n'est requis pour le LoRA :
- Télécharger
minimax_h3_ref2v_turbo_8step_v1.0_768p_comfyui_bf16.safetensorsdansComfyUI/models/loras/. - Charger le checkpoint MiniMax H3 de base dans un flux de travail Ref2V et appliquer le LoRA entre le chargeur de modèle et le sampler.
- Connecter une ou plusieurs images de référence via la branche d'entrée de référence et exécuter 8 étapes d'échantillonnage à 768p (par exemple 1344x768).
Le modèle de flux de travail officiel MiniMax H3 R2V est un bon point de départ. Les graphiques d'exemple du projet sont également à jour : video_minimax_h3_ref2v_lightx2v_turbo.json par défaut vers le checkpoint Ref2VA Turbo 4-étapes v0.1, et les graphiques T2VA/I2VA par défaut vers le FL2VA Turbo 8-étapes v1.0.
Pour la taille des images de référence, le projet recommande le mode match utilisé lors de l'entraînement de distillation, exposé via --reference-resize-mode dans son point d'entrée d'inférence.
Disponibilité
- Poids : lightx2v/Minimax-h3-Turbo sur Hugging Face (Apache-2.0), formats Diffusers et ComfyUI bf16
- Code et flux de travail : ModelTC/Minimax-H3-Turbo sur GitHub
- Hébergé : LightX2V Studio et l'API LightX2V exécutent la gamme Turbo dans le cloud
Commentaires
Connectez-vous avec GitHub pour rejoindre la discussion.