KJNodes/ltxvgenerated

LTXV Img To Video Inplace KJ(LTXVImgToVideoInplaceKJ)

Reemplaza los fotogramas latentes de vídeo con las imágenes de entrada codificadas, usa DynamicCombo que requiere ComfyUI 0.8.1 y frontend 1.33.4 o posterior.

LTXV Img To Video Inplace KJ

vae
latent
num_images
latent
KJNodes

Descripción

El Nodo LTXV Img To Video Inplace KJ reemplaza fotogramas específicos de un tensor latente de vídeo con imágenes codificadas en el espacio latente. Está diseñado para trabajar con modelos de vídeo como LTXV (Lightning Transformer Video) donde se desea insertar imágenes estáticas (por ejemplo, fotogramas clave, fotogramas de referencia) en la representación latente de una secuencia de vídeo.

El nodo utiliza una entrada DynamicCombo para la cantidad de imágenes a insertar, que crea dinámicamente entradas de imagen adicionales según el valor seleccionado. Esto requiere ComfyUI 0.8.1 y frontend 1.33.4 o posterior.

Entradas

NombreTipoDescripción
vaeVAEEl VAE de vídeo utilizado para codificar las imágenes de entrada en el espacio latente. Debe coincidir con el VAE que se usó para generar el latent de entrada.
latentLATENTEl tensor latente de vídeo original en el que se insertarán las imágenes codificadas. Se espera que el latente tenga una dimensión de lote que represente la cantidad de fotogramas.
num_imagesDYNAMICCOMBOUn menú desplegable/combobox para seleccionar cuántas imágenes desea insertar. Al seleccionar un número (ej. 3), se crearán dinámicamente esa cantidad de entradas de imagen adicionales (ej. image_1, image_2, image_3). Las imágenes se insertan en el orden en que aparecen, reemplazando las posiciones de fotograma correspondientes (comenzando desde el primer fotograma).

Nota sobre entradas dinámicas: Las etiquetas exactas y la cantidad de entradas de imagen dependen del valor seleccionado de num_images. Las imágenes deben proporcionarse como entradas IMAGE estándar (ej. cargadas mediante un nodo Cargar Imagen) y serán codificadas por el vae conectado antes de la inserción.

Salidas

NombreTipoDescripción
latentLATENTEl tensor latente de vídeo modificado con las imágenes codificadas insertadas en los fotogramas especificados. La dimensión de lote permanece igual que la del latent de entrada.

Notas de uso

  • Compatibilidad: Este nodo requiere ComfyUI 0.8.1 o posterior y frontend 1.33.4 o posterior para soportar la funcionalidad DynamicCombo. El uso de versiones anteriores generará errores o entradas faltantes.
  • Coincidencia del VAE: Asegúrese de que el VAE usado aquí coincida con el VAE que se usó para crear el latent de entrada. Usar un VAE no coincidente producirá una reconstrucción deficiente o artefactos.
  • Orden de fotogramas: Las imágenes se insertan en los primeros N fotogramas de la secuencia latente en el orden en que se suministran. Por ejemplo, si num_images = 2, image_1 reemplaza el fotograma 0 y image_2 reemplaza el fotograma 1. El resto de los fotogramas permanecen sin cambios.
  • Dimensiones del latente: El latent de entrada debe contener un lote de fotogramas con forma (N, C, H, W) donde N es la cantidad de fotogramas. Cada imagen codificada debe tener dimensiones espaciales que coincidan con (H, W) del latente para una inserción correcta.
  • Caso de uso: Este nodo es útil para acondicionar la generación de vídeo en fotogramas de referencia específicos, crear puntos de bucle consistentes o inyectar elementos visuales estáticos en un pipeline de vídeo.

Comentarios

Inicia sesión con GitHub para unirte a la conversación.

Cargando comentarios…
LTXV Img To Video Inplace KJ (LTXVImgToVideoInplaceKJ) - ComfyUI-KJNodes | ComfyUI Wiki