MiniMax H3 Turbo-SLA : LoRA FL2V 4 étapes pour ComfyUI

ComfyUI Wikinews

Lightx2v publie MiniMax H3 Turbo-SLA, une distillation FL2V en 4 étapes avec attention éparse à 85 %, environ 2,5 fois plus rapide sur RTX 5090, en formats LightX2V et ComfyUI.

L'équipe Lightx2v a publié MiniMax H3 Turbo-SLA, un checkpoint distillé en 4 étapes de premier/dernier plan vers vidéo (FL2V) pour MiniMax H3 qui combine distillation rapide et SLA (Sparse-Linear Attention) pour une inférence plus efficace (Hugging Face).

Démo côte à côte de MiniMax H3 Turbo-SLA

Comparaison côte à côte entre le modèle de base MiniMax H3 en 30 étapes et le modèle Turbo-SLA en 4 étapes

Le modèle utilise un taux de parcimonie d'attention de 85 %. Dans la configuration LightX2V testée, il offre environ 2,5 fois plus d'accélération d'inférence sur une NVIDIA RTX 5090 tout en conservant une qualité visuelle compétitive, et prend en charge la génération FL2V en 768p.

Your browser does not support the video tag.

Contenu de la publication

Le dépôt contient deux checkpoints BF16 du même LoRA FL2V en 4 étapes :

CheckpointFormatDescription
minimax_h3_fl2v_turbo_4step_v0.1_768p_sla_bf16.safetensorsLightX2VCheckpoint LoRA BF16 natif pour l'inférence LightX2V
minimax_h3_fl2v_turbo_4step_v0.1_768p_sla_comfyui_bf16.safetensorsComfyUICheckpoint LoRA BF16 converti pour les flux ComfyUI

Les deux checkpoints nécessitent les poids du modèle MiniMax-H3 original. Le chemin d'inférence LightX2V utilise une configuration SLA dédiée avec attn_type: dynamic_sparse_attn, un taux de parcimonie de 85 % avec l'opérateur sage2, et des décalages de flux vidéo/audio de 6,0/3,0.

Utilisation dans ComfyUI

MiniMax H3 est pris en charge nativement par ComfyUI, donc aucun nœud personnalisé n'est requis pour le LoRA :

  1. Téléchargez minimax_h3_fl2v_turbo_4step_v0.1_768p_sla_comfyui_bf16.safetensors dans ComfyUI/models/loras/.
  2. Chargez le checkpoint de base MiniMax H3 dans un flux FL2V et appliquez le LoRA entre le chargeur de modèle et l'échantillonneur.
  3. Exécutez 4 étapes d'échantillonnage en résolution 768p (par exemple 1344x768).

Cette publication poursuit la ligne Turbo de Lightx2v : les précédents v0.1 en 4 étapes et v1.0 en 8 étapes / 768p restent disponibles, et la variante SLA ajoute un chemin d'attention éparse pour ceux qui veulent encore plus de vitesse en plus de la distillation en 4 étapes.

Commentaires

Connectez-vous avec GitHub pour rejoindre la discussion.

Chargement des commentaires…
MiniMax H3 Turbo-SLA : LoRA FL2V 4 étapes pour ComfyUI | ComfyUI Wiki