FaceSwap LoRA de MiniMax H3 cambia al actor de tu vídeo
El LoRA FaceSwap de UntMods para MiniMax H3 Ref2VA cambia la identidad de un vídeo de referencia por la cara de tu imagen, con un flujo de trabajo de ComfyUI listo para usar.
Izquierda: la imagen de control que aporta la nueva identidad. Derecha: un fotograma del clip de salida generado con ella.
Qué cambia el LoRA
El reemplazo facial en MiniMax H3 normalmente implica forzar todo el conjunto de imágenes de referencia fuera de su comportamiento entrenado: la variante ref2va ya acepta imágenes de referencia, pero las usa para dirigir la apariencia, la ropa y la escena en lugar de sobrescribir al actor. Este adaptador reduce esa tarea a la cara. Le proporcionas el clip que quieres conservar y una o más imágenes de referencia de la nueva identidad, y una única palabra de activación, Faceswap, le indica al muestreador cuándo aplicar el intercambio.
Detalles prácticos de la ficha del modelo:
- Entrenado para
ref2va. Se aplica sobre los pesos H3 de referencia a vídeo y audio, no sobre la ramafl2va. - Una palabra de activación,
Faceswap, con fuerza 1.0. - Adaptador podado. Los bloques por debajo del umbral del autor se eliminan del archivo safetensors, lo que mantiene la descarga en 63 MB y, en palabras del autor, significa "menos artefactos de LoRA, idéntica fuerza que la base entrenada".
- Se permiten múltiples referencias. El flujo de trabajo incluido incorpora tres cargadores de imágenes de referencia e indica que el nodo "funciona con una o varias imágenes de referencia".
Los clips de demostración publicados son comparaciones de tres paneles con las etiquetas incrustadas: imagen de control a la izquierda, vídeo de referencia en el medio y salida intercambiada a la derecha.
Ejecutarlo en ComfyUI
El repositorio incluye SS_FaceSwap_MiniMax REF2V.json, un flujo de trabajo en formato de frontend creado sobre el paquete CRT-Nodes del propio autor, además de ComfyUI-VideoHelperSuite para cargar y multiplexar vídeo:
- Instala
CRT-Nodes(disponible en ComfyUI Manager comoCRT-Nodes) yComfyUI-VideoHelperSuite, y luego reinicia ComfyUI. - Descarga
SS_FaceSwap_MiniMax_H3_REF2VA.safetensorsdesde el repositorio del modelo enComfyUI/models/loras/MiniMaxH3/SS_FaceSwap/, que es la ruta que espera el flujo de trabajo. - Abre el flujo de trabajo, carga tu clip de origen en el cargador de vídeo VHS y tu nueva identidad en los cargadores de imágenes de referencia, y escribe
Faceswapen el prompt.
El flujo de trabajo de ejemplo conecta el LoRA a través de LoraLoaderModelOnly con fuerza 1.0 junto a una segunda ranura que contiene un LoRA turbo Ref2VA de 8 pasos, por lo que los clips de demostración se generan con recuentos de pasos acelerados. Su muestreador es el MiniMaxH3UnifiedSampler de CRT en modo R2V usando el preajuste "Balanced (recomendado)" del paquete; los clips de comparación publicados con el modelo están etiquetados como 0.7 strength. Las ranuras de checkpoint, codificador de texto y VAE apuntan a la base ref2va int8 convrot podada, al codificador de texto nvfp4 Qwen3-VL 32B y a los VAE separados de vídeo int8 y audio fp32 de H3.
La palabra de activación es solo la mitad del acondicionamiento: el adaptador está entrenado para tomar la identidad de las imágenes de referencia, por lo que el sujeto del propio clip conserva el movimiento, el tiempo, el encuadre y el audio mientras se reemplaza la cara.
Ejemplos de la ficha del modelo
La identidad que se transfiere no tiene por qué ser humana. En la segunda comparación publicada, un gato negro aporta la cara y el resultado se coloca sobre el presentador del clip de origen:
Imagen de control a la izquierda, vídeo de referencia en el medio y salida a la derecha.
Imagen de control, vídeo de referencia y salida con fuerza 0.7, con el audio conservado del clip de origen.
El mismo pipeline utilizado para mover la identidad de un gato a un presentador de estudio.
Disponibilidad
- Ficha del modelo y pesos: UntMods/FaceSwap_MiniMaxH3_REF2VA
- JSON del flujo de trabajo:
SS_FaceSwap_MiniMax REF2V.json - Paquete de Nodos: PGCRT/CRT-Nodes
El enlace se compartió en el canal #minimax_h3_chatter de Banodoco el 19 de septiembre, y la ficha del modelo ha acumulado más de 55 me gusta en sus primeros días. Las demostraciones publicadas son clips del propio entrenador; no habían aparecido resultados de pruebas de terceros en el momento de escribir esto.
Comentarios
Inicia sesión con GitHub para unirte a la conversación.