Le LoRA MiniMax H3 Realism People de fal pour ComfyUI

ComfyUI Wikinews

fal publie le LoRA MiniMax H3 Realism People : des personnes photoréalistes en T2V, I2V et R2V, avec des poids ouverts et un endpoint LoRA.

fal a publié le LoRA MiniMax H3 Realism People le 10 août, un adaptateur à poids ouverts spécialisé dans les personnes photoréalistes. Il succède au MiniMax-H3-Realism-LoRA précédent de fal, réentraîné sur un ensemble de données plus vaste axé sur les personnes, et est fourni sous la forme d'un seul fichier safetensors de 125 Mo qui couvre la génération texte-vers-vidéo, image-vers-vidéo et référence-vers-vidéo avec le mot déclencheur r34l1sm.

Une invite, une graine, seize configurations LoRA entraînées lors de la création de cet adaptateur

Une invite, une graine, seize configurations LoRA entraînées lors de la création de cet adaptateur (image issue de la carte officielle du modèle)

Ce qu'il fait

MiniMax H3 est déjà un modèle vidéo généraliste puissant. Cet adaptateur le pousse plus loin sur les plans centrés sur l'humain : des visages qui tiennent en gros plan, une texture de peau naturelle au lieu d'un lissage, des yeux et des micro-expressions cohérents, un éclairage façon film, et une qualité de caméra à main levée subtile, tout en conservant l'audio synchronisé natif de H3.

La carte du modèle appuie ces affirmations avec 19 paires AVANT/APRÈS utilisant la même invite et la même graine : la seule variable est le LoRA. La vidéo de comparaison ci-dessous joue chaque paire avec le modèle de base d'abord, puis la version adaptée à côté :

Comparaison AVANT/APRÈS de 197 secondes issue de la carte officielle du modèle : visages qui parlent en gros plan, disputes, peau marquée, enfants, scènes rituelles et de voyage

Comment l'utiliser dans ComfyUI

Les poids sont un LoRA safetensors standard, donc aucun nœud personnalisé n'est nécessaire :

  1. Téléchargez h3-realism-people-t2v-i2v-r2v.safetensors depuis le référentiel de modèles dans ComfyUI/models/loras/.
  2. Ajoutez un chargeur de LoRA à votre flux de travail MiniMax H3 (T2V, I2V ou Ref2V) et pointez-le vers le fichier.
  3. Commencez l'invite par le mot déclencheur r34l1sm et décrivez la scène. Une échelle de 1,0 est la force prévue ; réduisez-la entre 0,6 et 0,8 pour un effet plus léger.

Disponibilité

Le LoRA est gratuit et open-source sur Hugging Face (fal/MiniMax-H3-Realism-People-LoRA, 125 Mo, T2V/I2V/R2V dans un seul fichier). Il est également servi via le point de terminaison LoRA de fal à l'adresse fal.ai/models/minimax/h3/text-to-video/lora pour les utilisateurs de l'API.

Commentaires

Connectez-vous avec GitHub pour rejoindre la discussion.

Chargement des commentaires…
Le LoRA MiniMax H3 Realism People de fal pour ComfyUI | ComfyUI Wiki