Le LoRA FaceSwap de MiniMax H3 remplace l'acteur de votre vidéo
Le LoRA FaceSwap d'UntMods pour MiniMax H3 Ref2VA remplace l'identité d'une vidéo de référence par le visage de votre image, avec un workflow ComfyUI prêt à l'emploi.
À gauche : l'image de contrôle qui fournit la nouvelle identité. À droite : une frame du clip de sortie généré avec elle.
Ce que le LoRA change
Le remplacement de visage sur MiniMax H3 implique généralement de forcer toute la pile d'images de référence à s'écarter de son comportement entraîné : la variante ref2va accepte déjà des images de référence, mais elle les utilise pour orienter l'apparence, les vêtements et la scène plutôt que pour écraser l'acteur. Cet adaptateur réduit cette tâche au seul visage. Vous fournissez le clip que vous souhaitez conserver et une ou plusieurs images de référence de la nouvelle identité, et un seul mot déclencheur, Faceswap, indique à l'échantillonneur quand appliquer l'échange.
Détails pratiques issus de la carte du modèle :
- Entraîné pour
ref2va. Il s'applique par-dessus les poids H3 référence-vers-vidéo-et-audio, pas sur la branchefl2va. - Un mot déclencheur,
Faceswap, avec une force de 1.0. - Adaptateur élagué. Les blocs sous le seuil de l'auteur sont supprimés du fichier safetensors, ce qui maintient le téléchargement à 63 Mo et, selon les mots de l'auteur, signifie « moins d'artefacts LoRA, force identique à la base entraînée ».
- Références multiples autorisées. Le flux de travail fourni embarque trois chargeurs d'images de référence et précise que le nœud « fonctionne avec une ou plusieurs images de référence ».
Les clips de démonstration publiés sont des comparaisons à trois panneaux avec les étiquettes incrustées : image de contrôle à gauche, vidéo de référence au milieu, sortie échangée à droite.
L'exécuter dans ComfyUI
Le dépôt fournit SS_FaceSwap_MiniMax REF2V.json, un flux de travail au format frontend construit sur le pack CRT-Nodes de l'auteur ainsi que sur ComfyUI-VideoHelperSuite pour le chargement et le muxage vidéo :
- Installez
CRT-Nodes(disponible dans le ComfyUI Manager sous le nomCRT-Nodes) etComfyUI-VideoHelperSuite, puis redémarrez ComfyUI. - Téléchargez
SS_FaceSwap_MiniMax_H3_REF2VA.safetensorsdepuis le dépôt du modèle dansComfyUI/models/loras/MiniMaxH3/SS_FaceSwap/, qui est le chemin attendu par le flux de travail. - Ouvrez le flux de travail, chargez votre clip source dans le chargeur vidéo VHS et votre nouvelle identité dans les chargeurs d'images de référence, puis placez
Faceswapdans le prompt.
Le flux de travail d'exemple fait passer le LoRA par LoraLoaderModelOnly à une force de 1.0, à côté d'un second emplacement contenant un LoRA Ref2VA turbo de 8 étapes, afin que les clips de démonstration soient rendus avec des nombres d'étapes accélérés. Son échantillonneur est le MiniMaxH3UnifiedSampler de CRT en mode R2V, utilisant le préréglage « Balanced (recommended) » du pack ; les clips de comparaison publiés avec le modèle sont étiquetés 0.7 strength. Les emplacements checkpoint, encodeur de texte et VAE pointent vers la base ref2va int8 convrot élaguée, l'encodeur de texte nvfp4 Qwen3-VL 32B et les VAE distincts de H3 pour la vidéo (int8) et l'audio (fp32).
Le mot déclencheur ne représente que la moitié du conditionnement : l'adaptateur est entraîné à tirer l'identité des images de référence, de sorte que le sujet du clip conserve le mouvement, le timing, le cadrage et l'audio pendant que le visage est remplacé.
Exemples issus de la carte du modèle
L'identité transférée n'a pas besoin d'être humaine. Dans la deuxième comparaison publiée, un chat noir fournit le visage et le résultat se pose sur le présentateur du clip source :
Image de contrôle à gauche, vidéo de référence au milieu, sortie à droite.
Image de contrôle, vidéo de référence et sortie à une force de 0.7, avec l'audio conservé depuis le clip source.
Le même pipeline utilisé pour déplacer l'identité d'un chat sur un présentateur en studio.
Disponibilité
- Carte du modèle et poids : UntMods/FaceSwap_MiniMaxH3_REF2VA
- JSON du flux de travail :
SS_FaceSwap_MiniMax REF2V.json - Pack de nœuds : PGCRT/CRT-Nodes
Le lien a été partagé dans le salon #minimax_h3_chatter de Banodoco le 19 septembre, et la carte du modèle a récolté plus de 55 likes dans ses premiers jours. Les démos publiées sont les clips de l'entraîneur lui-même ; aucun résultat de test tiers n'avait été rendu public au moment de la rédaction.
Commentaires
Connectez-vous avec GitHub pour rejoindre la discussion.