MiniMax H3 Turbo LoRA : distillation FL2V en 4 étapes pour ComfyUI
Lightx2v et ModelTC distillent MiniMax H3 en un Turbo LoRA FL2V en 4 étapes, avec conversion ComfyUI et Spaces de démonstration.
L'équipe Lightx2v et ModelTC ont publié un Turbo LoRA en 4 étapes pour MiniMax H3, qui distille la génération FL2V du modèle vidéo (de la première et dernière image vers la vidéo), la faisant passer d'environ 20 étapes d'échantillonnage à 4 (Hugging Face, GitHub). Le LoRA, d'environ 1,3 Go, est une version préliminaire : la v0.1 se concentre sur la qualité FL2V, avec une distillation Ref2V déjà sur la feuille de route.
Une image de la sortie d'exemple de l'auteur à 4 étapes
Contenu de la version
- Poids :
minimax_h3_fl2v_turbo_4step_v0.1.safetensorssur Hugging Face, distillé à partir du modèle de base MiniMax-H3 - Code d'inférence : le référentiel ModelTC fournit une inférence MiniMax-H3 par lot ainsi que des comparaisons NFE/LoRA par rapport au modèle de base à 50 NFE
- Spaces de démonstration : le Space MiniMax-H3-Turbo-Lora d'akhaliq et un Space de l'organisation officielle vous permettent d'essayer le LoRA sans matériel local
- Feuille de route : améliorer les détails visuels FL2V et la qualité globale, puis développer une distillation basée sur Ref2V
Les notes de version présentent la v0.1 comme une version préliminaire : les détails visuels doivent encore être améliorés et une version mise à jour est en cours de développement.
Utilisation dans ComfyUI
ComfyUI n'a pas besoin d'un nœud personnalisé pour ce LoRA. Kijai a publié une conversion compatible ComfyUI dans Kijai/MiniMax-H3_comfy (minimax_h3_fl2v_lightx2v_turbo_4step_v0.1_comfy.safetensors, plus une variante bf16 redimensionnée) moins d'une heure après la sortie. Déposez le fichier dans models/loras/, chargez le checkpoint H3 de base et appliquez le LoRA à 0,75 de force avec 4 étapes à l'aide d'un échantillonneur er_sde ou sa_solver, selon les notes de test de Kijai.
Le modèle de flux de travail texte-vers-vidéo MiniMax H3 officiel est un bon point de départ ; insérez le Turbo LoRA entre le chargeur de modèle et l'échantillonneur et basculez vers les paramètres en 4 étapes ci-dessus.
Remarque : les auteurs ont observé quelques différences entre les résultats d'inférence de Diffusers et de ComfyUI (l'audio semblait plus naturel dans Diffusers). Un bug audio dans le chemin ComfyUI a été corrigé dans une mise à jour nocturne. Pour reproduire les résultats de l'article, suivez le script d'inférence ModelTC.
Exemple de sortie partagé par les auteurs dans la discussion de la sortie
Disponibilité
- Poids : lightx2v/Minimax-h3-Turbo sur Hugging Face
- Code : ModelTC/Minimax-H3-Turbo sur GitHub
- Conversion ComfyUI : Kijai/MiniMax-H3_comfy
- Démo : Space MiniMax-H3-Turbo-Lora
Commentaires
Connectez-vous avec GitHub pour rejoindre la discussion.