FaceSwap LoRA de MiniMax H3 cambia al actor de tu vídeo

ComfyUI Wikinews

El LoRA FaceSwap de UntMods para MiniMax H3 Ref2VA cambia la identidad de un vídeo de referencia por la cara de tu imagen, con un flujo de trabajo de ComfyUI listo para usar.

FaceSwap_MiniMaxH3_REF2VA es un LoRA para MiniMax H3 Ref2VA que intercambia la identidad de un vídeo de referencia por la cara de tu imagen de referencia. Publicado el 15 de septiembre por el entrenador responsable del paquete CRT-Nodes, llega con un flujo de trabajo de ComfyUI funcional, una palabra de activación y un único archivo de pesos de 63 MB.
Imagen de control y el fotograma de salida intercambiado

Izquierda: la imagen de control que aporta la nueva identidad. Derecha: un fotograma del clip de salida generado con ella.

Qué cambia el LoRA

El reemplazo facial en MiniMax H3 normalmente implica forzar todo el conjunto de imágenes de referencia fuera de su comportamiento entrenado: la variante ref2va ya acepta imágenes de referencia, pero las usa para dirigir la apariencia, la ropa y la escena en lugar de sobrescribir al actor. Este adaptador reduce esa tarea a la cara. Le proporcionas el clip que quieres conservar y una o más imágenes de referencia de la nueva identidad, y una única palabra de activación, Faceswap, le indica al muestreador cuándo aplicar el intercambio.

Detalles prácticos de la ficha del modelo:

  • Entrenado para ref2va. Se aplica sobre los pesos H3 de referencia a vídeo y audio, no sobre la rama fl2va.
  • Una palabra de activación, Faceswap, con fuerza 1.0.
  • Adaptador podado. Los bloques por debajo del umbral del autor se eliminan del archivo safetensors, lo que mantiene la descarga en 63 MB y, en palabras del autor, significa "menos artefactos de LoRA, idéntica fuerza que la base entrenada".
  • Se permiten múltiples referencias. El flujo de trabajo incluido incorpora tres cargadores de imágenes de referencia e indica que el nodo "funciona con una o varias imágenes de referencia".
Imagen de control, vídeo de referencia y salida intercambiada

Los clips de demostración publicados son comparaciones de tres paneles con las etiquetas incrustadas: imagen de control a la izquierda, vídeo de referencia en el medio y salida intercambiada a la derecha.

Ejecutarlo en ComfyUI

El repositorio incluye SS_FaceSwap_MiniMax REF2V.json, un flujo de trabajo en formato de frontend creado sobre el paquete CRT-Nodes del propio autor, además de ComfyUI-VideoHelperSuite para cargar y multiplexar vídeo:

  1. Instala CRT-Nodes (disponible en ComfyUI Manager como CRT-Nodes) y ComfyUI-VideoHelperSuite, y luego reinicia ComfyUI.
  2. Descarga SS_FaceSwap_MiniMax_H3_REF2VA.safetensors desde el repositorio del modelo en ComfyUI/models/loras/MiniMaxH3/SS_FaceSwap/, que es la ruta que espera el flujo de trabajo.
  3. Abre el flujo de trabajo, carga tu clip de origen en el cargador de vídeo VHS y tu nueva identidad en los cargadores de imágenes de referencia, y escribe Faceswap en el prompt.

El flujo de trabajo de ejemplo conecta el LoRA a través de LoraLoaderModelOnly con fuerza 1.0 junto a una segunda ranura que contiene un LoRA turbo Ref2VA de 8 pasos, por lo que los clips de demostración se generan con recuentos de pasos acelerados. Su muestreador es el MiniMaxH3UnifiedSampler de CRT en modo R2V usando el preajuste "Balanced (recomendado)" del paquete; los clips de comparación publicados con el modelo están etiquetados como 0.7 strength. Las ranuras de checkpoint, codificador de texto y VAE apuntan a la base ref2va int8 convrot podada, al codificador de texto nvfp4 Qwen3-VL 32B y a los VAE separados de vídeo int8 y audio fp32 de H3.

La palabra de activación es solo la mitad del acondicionamiento: el adaptador está entrenado para tomar la identidad de las imágenes de referencia, por lo que el sujeto del propio clip conserva el movimiento, el tiempo, el encuadre y el audio mientras se reemplaza la cara.

Ejemplos de la ficha del modelo

La identidad que se transfiere no tiene por qué ser humana. En la segunda comparación publicada, un gato negro aporta la cara y el resultado se coloca sobre el presentador del clip de origen:

Identidad de un gato intercambiada sobre un presentador de estudio

Imagen de control a la izquierda, vídeo de referencia en el medio y salida a la derecha.

Imagen de control, vídeo de referencia y salida con fuerza 0.7, con el audio conservado del clip de origen.

El mismo pipeline utilizado para mover la identidad de un gato a un presentador de estudio.

Disponibilidad

El enlace se compartió en el canal #minimax_h3_chatter de Banodoco el 19 de septiembre, y la ficha del modelo ha acumulado más de 55 me gusta en sus primeros días. Las demostraciones publicadas son clips del propio entrenador; no habían aparecido resultados de pruebas de terceros en el momento de escribir esto.

Comentarios

Inicia sesión con GitHub para unirte a la conversación.

Cargando comentarios…
FaceSwap LoRA de MiniMax H3 cambia al actor de tu vídeo | ComfyUI Wiki