MiniMax H3 FL2V Turbo 4-étapes v1.2 LoRA : Audio plus propre
Télécharger minimax_h3_fl2v_turbo_4step_v1.2_768p_comfyui_bf16.safetensors : Mise à jour 4-étapes de MiniMax H3 Turbo par LightX2V avec génération audio plus propre et plus stable.
L'équipe LightX2V a publié FL2V Turbo 4-étapes v1.2 768p, la dernière entrée dans la ligne de distillation Minimax-h3-Turbo. La v1.2 conserve le même paramétrage de génération rapide en 4 étapes que v1.1 et se concentre entièrement sur une faiblesse : la qualité audio. La comparaison de la publication montre un audio généré plus propre et plus stable avec moins d'artefacts à des paramètres identiques (discussion de la publication).
Ce qui a changé dans la v1.2
La v1.2 est un rafraîchissement de la qualité audio du LoRA FL2V (première/dernière image) 4-étapes 768p plutôt qu'une nouvelle architecture :
- Audio plus propre et plus stable avec moins d'artefacts
- Même configuration de génération 4-étapes (NFE 4) que v1.1
- Les poids Diffusers et ComfyUI bf16 publiés côte à côte
| Fichier | Format |
|---|---|
minimax_h3_fl2v_turbo_4step_v1.2_768p_bf16.safetensors | Diffusers |
minimax_h3_fl2v_turbo_4step_v1.2_768p_comfyui_bf16.safetensors | ComfyUI, aucune conversion requise |
Comparaison v1.1 vs v1.2 (activer l'audio)
L'équipe a partagé des comparaisons dos à dos utilisant la même entrée, invite, graine et paramètres d'inférence :
| v1.1 | v1.2 |
|---|---|
Paramètres recommandés
| Paramètre | Valeur |
|---|---|
| Étapes | 4 |
| Décalage vidéo | 6 |
| Décalage audio | 3 |
| Échantillonneur | Euler |
| Résolution | Jusqu'à 768p |
Les décalages vidéo et audio sont définis via le nœud ModelSamplingMiniMaxH3, connecté après le chargeur de modèle de diffusion. Notez que certains premiers testeurs sur le fil de discussion Hugging Face ont estimé que la qualité visuelle avait souffert par rapport à v1.1, donc si la qualité vidéo compte plus que l'audio dans votre pipeline, garder v1.1 est un choix raisonnable.
Utilisation ComfyUI
MiniMax H3 dispose d'un support natif ComfyUI, donc aucun nœud personnalisé n'est requis pour le LoRA :
- Télécharger
minimax_h3_fl2v_turbo_4step_v1.2_768p_comfyui_bf16.safetensorsdansComfyUI/models/loras/. - Charger le checkpoint de base MiniMax H3 et appliquer le LoRA entre le chargeur de modèle et l'échantillonneur.
- Définir 4 étapes d'échantillonnage, échantillonneur Euler, décalage vidéo 6 et décalage audio 3 via
ModelSamplingMiniMaxH3, puis générer jusqu'à 768p.
Les graphiques d'exemple propres au projet dans ModelTC/Minimax-H3-Turbo sont également à jour ; les graphiques T2VA/I2VA sont les plus proches correspondants pour le chemin FL2V.
Disponibilité
- Poids : lightx2v/Minimax-h3-Turbo sur Hugging Face (Apache-2.0), formats Diffusers et ComfyUI bf16
- Code et flux de travail : ModelTC/Minimax-H3-Turbo sur GitHub
- Hébergé : LightX2V Studio exécute la ligne Turbo dans le cloud
Commentaires
Connectez-vous avec GitHub pour rejoindre la discussion.