MiniMax H3 FL2V Turbo 4-étapes v1.2 LoRA : Audio plus propre

ComfyUI Wikinews

Télécharger minimax_h3_fl2v_turbo_4step_v1.2_768p_comfyui_bf16.safetensors : Mise à jour 4-étapes de MiniMax H3 Turbo par LightX2V avec génération audio plus propre et plus stable.

L'équipe LightX2V a publié FL2V Turbo 4-étapes v1.2 768p, la dernière entrée dans la ligne de distillation Minimax-h3-Turbo. La v1.2 conserve le même paramétrage de génération rapide en 4 étapes que v1.1 et se concentre entièrement sur une faiblesse : la qualité audio. La comparaison de la publication montre un audio généré plus propre et plus stable avec moins d'artefacts à des paramètres identiques (discussion de la publication).

MiniMax H3 FL2V Turbo v1.2 exemple de trame

Ce qui a changé dans la v1.2

La v1.2 est un rafraîchissement de la qualité audio du LoRA FL2V (première/dernière image) 4-étapes 768p plutôt qu'une nouvelle architecture :

  • Audio plus propre et plus stable avec moins d'artefacts
  • Même configuration de génération 4-étapes (NFE 4) que v1.1
  • Les poids Diffusers et ComfyUI bf16 publiés côte à côte
FichierFormat
minimax_h3_fl2v_turbo_4step_v1.2_768p_bf16.safetensorsDiffusers
minimax_h3_fl2v_turbo_4step_v1.2_768p_comfyui_bf16.safetensorsComfyUI, aucune conversion requise

Comparaison v1.1 vs v1.2 (activer l'audio)

L'équipe a partagé des comparaisons dos à dos utilisant la même entrée, invite, graine et paramètres d'inférence :

v1.1v1.2

Paramètres recommandés

ParamètreValeur
Étapes4
Décalage vidéo6
Décalage audio3
ÉchantillonneurEuler
RésolutionJusqu'à 768p

Les décalages vidéo et audio sont définis via le nœud ModelSamplingMiniMaxH3, connecté après le chargeur de modèle de diffusion. Notez que certains premiers testeurs sur le fil de discussion Hugging Face ont estimé que la qualité visuelle avait souffert par rapport à v1.1, donc si la qualité vidéo compte plus que l'audio dans votre pipeline, garder v1.1 est un choix raisonnable.

Utilisation ComfyUI

MiniMax H3 dispose d'un support natif ComfyUI, donc aucun nœud personnalisé n'est requis pour le LoRA :

  1. Télécharger minimax_h3_fl2v_turbo_4step_v1.2_768p_comfyui_bf16.safetensors dans ComfyUI/models/loras/.
  2. Charger le checkpoint de base MiniMax H3 et appliquer le LoRA entre le chargeur de modèle et l'échantillonneur.
  3. Définir 4 étapes d'échantillonnage, échantillonneur Euler, décalage vidéo 6 et décalage audio 3 via ModelSamplingMiniMaxH3, puis générer jusqu'à 768p.

Les graphiques d'exemple propres au projet dans ModelTC/Minimax-H3-Turbo sont également à jour ; les graphiques T2VA/I2VA sont les plus proches correspondants pour le chemin FL2V.

Disponibilité

Commentaires

Connectez-vous avec GitHub pour rejoindre la discussion.

Chargement des commentaires…
MiniMax H3 FL2V Turbo 4-étapes v1.2 LoRA : Audio plus propre | ComfyUI Wiki