MiniMax H3 Turbo Ref2V v0.1 : LoRA de référence-vers-vidéo en 4 étapes
Lightx2v et ModelTC publient MiniMax H3 Turbo Ref2V v0.1, un LoRA de référence-vers-vidéo en 4 étapes avec des poids bf16 prêts pour ComfyUI et la génération multi-références.
Le 13 août, les équipes Lightx2v et ModelTC ont publié Ref2V Turbo v0.1, la version référence-vers-vidéo de leur gamme de LoRA MiniMax H3 Turbo. Suite à la sortie de FL2V Turbo v1.0 le 11 août, le nouveau checkpoint apporte la même distillation en 4 étapes à Ref2VA (référence-vers-vidéo + audio), permettant à une vidéo d'être pilotée par une ou plusieurs images de référence au lieu d'une seule première image.
Référence de personnage issue des ressources de test Ref2V de Lightx2v
Contenu de la v0.1
| Modèle | Tâches | Résolution d'entraînement | Décalages d'entraînement (Vidéo / Audio) | Étapes de distillation (NFE) | Étapes d'inférence recommandées |
|---|---|---|---|---|---|
| Ref2VA Turbo 4-step v0.1 | Ref2VA | 544p (AR mixte) | 12 / 3 | 4 | 4 |
La version v0.1 se compose de deux fichiers sur Hugging Face :
minimax_h3_ref2v_turbo_4step_v0.1_bf16.safetensorspour Diffusersminimax_h3_ref2v_turbo_4step_v0.1_comfyui_bf16.safetensorsprêt à être déposé dans ComfyUI, sans conversion nécessaire
Pour la politique de redimensionnement des images de référence, le projet recommande le mode match utilisé lors de l'entraînement de distillation, qui fait correspondre la surface en pixels de la référence à la toile cible tout en préservant son rapport d'aspect et sans jamais agrandir une référence plus petite. Les trois politiques prises en charge conservent le rapport d'aspect de la référence et utilisent la grille de résolution H3 (dimensions arrondies aux multiples de 32) sans recadrer le contenu de la référence.
Utilisation dans ComfyUI
MiniMax H3 dispose d'une prise en charge native de ComfyUI, donc aucun nœud personnalisé n'est requis pour le LoRA :
- Téléchargez
minimax_h3_ref2v_turbo_4step_v0.1_comfyui_bf16.safetensorsdansComfyUI/models/loras/. - Chargez le checkpoint MiniMax H3 de base dans un flux de travail Ref2V et appliquez le LoRA entre le chargeur de modèle et l'échantillonneur.
- Connectez une ou plusieurs images de référence via la branche d'entrée de référence et exécutez 4 étapes d'échantillonnage.
Le modèle de flux de travail officiel MiniMax H3 R2V est un bon point de départ. Le projet fournit également un graphique d'exemple dédié, video_minimax_h3_ref2v_lightx2v_turbo.json, qui utilise par défaut le checkpoint Ref2VA Turbo 4-step v0.1 en 960x544 (16:9, 0,5 MP).
Disponibilité
- Poids : lightx2v/Minimax-h3-Turbo sur Hugging Face (formats bf16 Diffusers et ComfyUI)
- Code et flux de travail : ModelTC/Minimax-H3-Turbo sur GitHub
- Modèle ComfyUI officiel : video_minimax_h3_r2v dans Comfy-Org/workflow_templates
Commentaires
Connectez-vous avec GitHub pour rejoindre la discussion.