MiniMax H3 Turbo-SLA : LoRA FL2V 4 étapes pour ComfyUI
Lightx2v publie MiniMax H3 Turbo-SLA, une distillation FL2V en 4 étapes avec attention éparse à 85 %, environ 2,5 fois plus rapide sur RTX 5090, en formats LightX2V et ComfyUI.
L'équipe Lightx2v a publié MiniMax H3 Turbo-SLA, un checkpoint distillé en 4 étapes de premier/dernier plan vers vidéo (FL2V) pour MiniMax H3 qui combine distillation rapide et SLA (Sparse-Linear Attention) pour une inférence plus efficace (Hugging Face).
Comparaison côte à côte entre le modèle de base MiniMax H3 en 30 étapes et le modèle Turbo-SLA en 4 étapes
Le modèle utilise un taux de parcimonie d'attention de 85 %. Dans la configuration LightX2V testée, il offre environ 2,5 fois plus d'accélération d'inférence sur une NVIDIA RTX 5090 tout en conservant une qualité visuelle compétitive, et prend en charge la génération FL2V en 768p.
Contenu de la publication
Le dépôt contient deux checkpoints BF16 du même LoRA FL2V en 4 étapes :
| Checkpoint | Format | Description |
|---|---|---|
minimax_h3_fl2v_turbo_4step_v0.1_768p_sla_bf16.safetensors | LightX2V | Checkpoint LoRA BF16 natif pour l'inférence LightX2V |
minimax_h3_fl2v_turbo_4step_v0.1_768p_sla_comfyui_bf16.safetensors | ComfyUI | Checkpoint LoRA BF16 converti pour les flux ComfyUI |
Les deux checkpoints nécessitent les poids du modèle MiniMax-H3 original. Le chemin d'inférence LightX2V utilise une configuration SLA dédiée avec attn_type: dynamic_sparse_attn, un taux de parcimonie de 85 % avec l'opérateur sage2, et des décalages de flux vidéo/audio de 6,0/3,0.
Utilisation dans ComfyUI
MiniMax H3 est pris en charge nativement par ComfyUI, donc aucun nœud personnalisé n'est requis pour le LoRA :
- Téléchargez
minimax_h3_fl2v_turbo_4step_v0.1_768p_sla_comfyui_bf16.safetensorsdansComfyUI/models/loras/. - Chargez le checkpoint de base MiniMax H3 dans un flux FL2V et appliquez le LoRA entre le chargeur de modèle et l'échantillonneur.
- Exécutez 4 étapes d'échantillonnage en résolution 768p (par exemple 1344x768).
Cette publication poursuit la ligne Turbo de Lightx2v : les précédents v0.1 en 4 étapes et v1.0 en 8 étapes / 768p restent disponibles, et la variante SLA ajoute un chemin d'attention éparse pour ceux qui veulent encore plus de vitesse en plus de la distillation en 4 étapes.
Commentaires
Connectez-vous avec GitHub pour rejoindre la discussion.