Le LoRA MiniMax H3 Realism People de fal pour ComfyUI
fal publie le LoRA MiniMax H3 Realism People : des personnes photoréalistes en T2V, I2V et R2V, avec des poids ouverts et un endpoint LoRA.
fal a publié le LoRA MiniMax H3 Realism People le 10 août, un adaptateur à poids ouverts spécialisé dans les personnes photoréalistes. Il succède au MiniMax-H3-Realism-LoRA précédent de fal, réentraîné sur un ensemble de données plus vaste axé sur les personnes, et est fourni sous la forme d'un seul fichier safetensors de 125 Mo qui couvre la génération texte-vers-vidéo, image-vers-vidéo et référence-vers-vidéo avec le mot déclencheur r34l1sm.
Une invite, une graine, seize configurations LoRA entraînées lors de la création de cet adaptateur (image issue de la carte officielle du modèle)
Ce qu'il fait
MiniMax H3 est déjà un modèle vidéo généraliste puissant. Cet adaptateur le pousse plus loin sur les plans centrés sur l'humain : des visages qui tiennent en gros plan, une texture de peau naturelle au lieu d'un lissage, des yeux et des micro-expressions cohérents, un éclairage façon film, et une qualité de caméra à main levée subtile, tout en conservant l'audio synchronisé natif de H3.
La carte du modèle appuie ces affirmations avec 19 paires AVANT/APRÈS utilisant la même invite et la même graine : la seule variable est le LoRA. La vidéo de comparaison ci-dessous joue chaque paire avec le modèle de base d'abord, puis la version adaptée à côté :
Comparaison AVANT/APRÈS de 197 secondes issue de la carte officielle du modèle : visages qui parlent en gros plan, disputes, peau marquée, enfants, scènes rituelles et de voyage
Comment l'utiliser dans ComfyUI
Les poids sont un LoRA safetensors standard, donc aucun nœud personnalisé n'est nécessaire :
- Téléchargez
h3-realism-people-t2v-i2v-r2v.safetensorsdepuis le référentiel de modèles dansComfyUI/models/loras/. - Ajoutez un chargeur de LoRA à votre flux de travail MiniMax H3 (T2V, I2V ou Ref2V) et pointez-le vers le fichier.
- Commencez l'invite par le mot déclencheur
r34l1smet décrivez la scène. Une échelle de 1,0 est la force prévue ; réduisez-la entre 0,6 et 0,8 pour un effet plus léger.
Disponibilité
Le LoRA est gratuit et open-source sur Hugging Face (fal/MiniMax-H3-Realism-People-LoRA, 125 Mo, T2V/I2V/R2V dans un seul fichier). Il est également servi via le point de terminaison LoRA de fal à l'adresse fal.ai/models/minimax/h3/text-to-video/lora pour les utilisateurs de l'API.
Commentaires
Connectez-vous avec GitHub pour rejoindre la discussion.