MiniMax H3 Turbo Ref2VA 8-Étapes v1.0 : LoRA Référence-vers-Vidéo

ComfyUI Wikinews

Télécharger minimax_h3_ref2v_turbo_8step_v1.0_comfyui_bf16.safetensors : distillation Ref2VA 8 étapes 768p de Lightx2v pour MiniMax H3, avec audio et exemples.

L'équipe Lightx2v et ModelTC ont mis à jour Minimax-h3-Turbo avec Ref2VA Turbo 8-étapes v1.0 768p, une distillation 8-étapes 768p du chemin référence-vers-vidéo : une ou plusieurs images de référence pilotent une vidéo générée avec audio, à une fraction du nombre d'étapes du modèle de base (dépôt de sortie).

Cela comble la dernière lacune dans la gamme Turbo. Le côté FL2VA avait déjà des checkpoints 8-étapes et 768p depuis la sortie v1.0, tandis que Ref2VA n'avait que le 4-étapes v0.1 à 544p.

Spécifications du modèle

Le tableau des spécifications du modèle liste maintenant six checkpoints à travers FL2VA et Ref2VA. La nouvelle entrée :

ModèleTâchesRésolution d'entraînementDécalages d'entraînement (vidéo / audio)Étapes de distillation (NFE)Étapes d'inférence recommandées
Ref2VA Turbo 8-étapes v1.0 768pRef2VA768p (1344x768)6 / 388

Deux fichiers sont disponibles pour ce modèle sur Hugging Face :

  • minimax_h3_ref2v_turbo_8step_v1.0_768p_bf16.safetensors pour Diffusers
  • minimax_h3_ref2v_turbo_8step_v1.0_768p_comfyui_bf16.safetensors prêt pour ComfyUI, aucune conversion nécessaire
Studio LightX2V exécutant le LoRA MiniMax H3 Turbo

Le Studio LightX2V sert actuellement le LoRA FL2VA Turbo 8-étapes v1.0 768p ; le même dépôt couvre désormais le chemin Ref2VA à 8 étapes et 768p.

Utilisation ComfyUI

MiniMax H3 dispose d'un support natif ComfyUI, donc aucun nœud personnalisé n'est requis pour le LoRA :

  1. Télécharger minimax_h3_ref2v_turbo_8step_v1.0_768p_comfyui_bf16.safetensors dans ComfyUI/models/loras/.
  2. Charger le checkpoint MiniMax H3 de base dans un flux de travail Ref2V et appliquer le LoRA entre le chargeur de modèle et le sampler.
  3. Connecter une ou plusieurs images de référence via la branche d'entrée de référence et exécuter 8 étapes d'échantillonnage à 768p (par exemple 1344x768).

Le modèle de flux de travail officiel MiniMax H3 R2V est un bon point de départ. Les graphiques d'exemple du projet sont également à jour : video_minimax_h3_ref2v_lightx2v_turbo.json par défaut vers le checkpoint Ref2VA Turbo 4-étapes v0.1, et les graphiques T2VA/I2VA par défaut vers le FL2VA Turbo 8-étapes v1.0.

Pour la taille des images de référence, le projet recommande le mode match utilisé lors de l'entraînement de distillation, exposé via --reference-resize-mode dans son point d'entrée d'inférence.

Disponibilité

Commentaires

Connectez-vous avec GitHub pour rejoindre la discussion.

Chargement des commentaires…
MiniMax H3 Turbo Ref2VA 8-Étapes v1.0 : LoRA Référence-vers-Vidéo | ComfyUI Wiki