Descripción
El Nodo LTXV Img To Video Inplace KJ reemplaza fotogramas específicos de un tensor latente de vídeo con imágenes codificadas en el espacio latente. Está diseñado para trabajar con modelos de vídeo como LTXV (Lightning Transformer Video) donde se desea insertar imágenes estáticas (por ejemplo, fotogramas clave, fotogramas de referencia) en la representación latente de una secuencia de vídeo.
El nodo utiliza una entrada DynamicCombo para la cantidad de imágenes a insertar, que crea dinámicamente entradas de imagen adicionales según el valor seleccionado. Esto requiere ComfyUI 0.8.1 y frontend 1.33.4 o posterior.
Entradas
| Nombre | Tipo | Descripción |
|---|---|---|
vae | VAE | El VAE de vídeo utilizado para codificar las imágenes de entrada en el espacio latente. Debe coincidir con el VAE que se usó para generar el latent de entrada. |
latent | LATENT | El tensor latente de vídeo original en el que se insertarán las imágenes codificadas. Se espera que el latente tenga una dimensión de lote que represente la cantidad de fotogramas. |
num_images | DYNAMICCOMBO | Un menú desplegable/combobox para seleccionar cuántas imágenes desea insertar. Al seleccionar un número (ej. 3), se crearán dinámicamente esa cantidad de entradas de imagen adicionales (ej. image_1, image_2, image_3). Las imágenes se insertan en el orden en que aparecen, reemplazando las posiciones de fotograma correspondientes (comenzando desde el primer fotograma). |
Nota sobre entradas dinámicas: Las etiquetas exactas y la cantidad de entradas de imagen dependen del valor seleccionado de
num_images. Las imágenes deben proporcionarse como entradasIMAGEestándar (ej. cargadas mediante un nodo Cargar Imagen) y serán codificadas por elvaeconectado antes de la inserción.
Salidas
| Nombre | Tipo | Descripción |
|---|---|---|
latent | LATENT | El tensor latente de vídeo modificado con las imágenes codificadas insertadas en los fotogramas especificados. La dimensión de lote permanece igual que la del latent de entrada. |
Notas de uso
- Compatibilidad: Este nodo requiere ComfyUI 0.8.1 o posterior y frontend 1.33.4 o posterior para soportar la funcionalidad DynamicCombo. El uso de versiones anteriores generará errores o entradas faltantes.
- Coincidencia del VAE: Asegúrese de que el VAE usado aquí coincida con el VAE que se usó para crear el
latentde entrada. Usar un VAE no coincidente producirá una reconstrucción deficiente o artefactos. - Orden de fotogramas: Las imágenes se insertan en los primeros N fotogramas de la secuencia latente en el orden en que se suministran. Por ejemplo, si
num_images = 2,image_1reemplaza el fotograma 0 yimage_2reemplaza el fotograma 1. El resto de los fotogramas permanecen sin cambios. - Dimensiones del latente: El
latentde entrada debe contener un lote de fotogramas con forma(N, C, H, W)dondeNes la cantidad de fotogramas. Cada imagen codificada debe tener dimensiones espaciales que coincidan con(H, W)del latente para una inserción correcta. - Caso de uso: Este nodo es útil para acondicionar la generación de vídeo en fotogramas de referencia específicos, crear puntos de bucle consistentes o inyectar elementos visuales estáticos en un pipeline de vídeo.
Comentarios
Inicia sesión con GitHub para unirte a la conversación.