MiniMax H3 Turbo Ref2V v0.1 : LoRA de référence-vers-vidéo en 4 étapes

ComfyUI Wikinews

Lightx2v et ModelTC publient MiniMax H3 Turbo Ref2V v0.1, un LoRA de référence-vers-vidéo en 4 étapes avec des poids bf16 prêts pour ComfyUI et la génération multi-références.

Le 13 août, les équipes Lightx2v et ModelTC ont publié Ref2V Turbo v0.1, la version référence-vers-vidéo de leur gamme de LoRA MiniMax H3 Turbo. Suite à la sortie de FL2V Turbo v1.0 le 11 août, le nouveau checkpoint apporte la même distillation en 4 étapes à Ref2VA (référence-vers-vidéo + audio), permettant à une vidéo d'être pilotée par une ou plusieurs images de référence au lieu d'une seule première image.

Référence de personnage issue des ressources de test Ref2V de Lightx2v

Référence de personnage issue des ressources de test Ref2V de Lightx2v

Contenu de la v0.1

ModèleTâchesRésolution d'entraînementDécalages d'entraînement (Vidéo / Audio)Étapes de distillation (NFE)Étapes d'inférence recommandées
Ref2VA Turbo 4-step v0.1Ref2VA544p (AR mixte)12 / 344

La version v0.1 se compose de deux fichiers sur Hugging Face :

  • minimax_h3_ref2v_turbo_4step_v0.1_bf16.safetensors pour Diffusers
  • minimax_h3_ref2v_turbo_4step_v0.1_comfyui_bf16.safetensors prêt à être déposé dans ComfyUI, sans conversion nécessaire

Pour la politique de redimensionnement des images de référence, le projet recommande le mode match utilisé lors de l'entraînement de distillation, qui fait correspondre la surface en pixels de la référence à la toile cible tout en préservant son rapport d'aspect et sans jamais agrandir une référence plus petite. Les trois politiques prises en charge conservent le rapport d'aspect de la référence et utilisent la grille de résolution H3 (dimensions arrondies aux multiples de 32) sans recadrer le contenu de la référence.

Utilisation dans ComfyUI

MiniMax H3 dispose d'une prise en charge native de ComfyUI, donc aucun nœud personnalisé n'est requis pour le LoRA :

  1. Téléchargez minimax_h3_ref2v_turbo_4step_v0.1_comfyui_bf16.safetensors dans ComfyUI/models/loras/.
  2. Chargez le checkpoint MiniMax H3 de base dans un flux de travail Ref2V et appliquez le LoRA entre le chargeur de modèle et l'échantillonneur.
  3. Connectez une ou plusieurs images de référence via la branche d'entrée de référence et exécutez 4 étapes d'échantillonnage.

Le modèle de flux de travail officiel MiniMax H3 R2V est un bon point de départ. Le projet fournit également un graphique d'exemple dédié, video_minimax_h3_ref2v_lightx2v_turbo.json, qui utilise par défaut le checkpoint Ref2VA Turbo 4-step v0.1 en 960x544 (16:9, 0,5 MP).

Disponibilité

Commentaires

Connectez-vous avec GitHub pour rejoindre la discussion.

Chargement des commentaires…
MiniMax H3 Turbo Ref2V v0.1 : LoRA de référence-vers-vidéo en 4 étapes | ComfyUI Wiki