KJNodes/imagegenerated

Codificar Componentes de Vídeo(EncodeVideoComponents)

Extrae fotogramas de vídeo, los redimensiona y los codifica directamente con un VAE, evitando almacenar el tensor de imagen completo.

Encode Video Components

video
vae
keep_proportion
latent
audio
fps
frame_count
width
768
height
512
max_frames
0
upscale_method
lanczos
KJNodes

Descripción

El nodo Codificar Componentes de Vídeo extrae fotogramas de un vídeo, los redimensiona a una resolución especificada y los codifica directamente a través de un VAE en una representación latente. Procesa los fotogramas uno por uno, evitando el costo de memoria de almacenar el tensor de imagen completo para todo el vídeo a la vez. El nodo también pasa la pista de audio del vídeo de entrada y genera metadatos como la tasa de fotogramas y el número total de fotogramas.

Entradas

  • video (VÍDEO, Requerido) — El archivo de vídeo o secuencia a procesar. Debe ser una entrada de vídeo válida según lo aceptado por ComfyUI-KJNodes.
  • vae (VAE, Requerido) — El modelo VAE utilizado para codificar los fotogramas redimensionados en el espacio latente.
  • width (ENTERO, por defecto: 768, rango: 016384, paso: 2) — Ancho objetivo para cada fotograma antes de la codificación. Establece en 0 para mantener el ancho original del vídeo.
  • height (ENTERO, por defecto: 512, rango: 016384, paso: 2) — Alto objetivo para cada fotograma antes de la codificación. Establece en 0 para mantener el alto original del vídeo.
  • max_frames (ENTERO, por defecto: 0, rango: 0999999, paso: 1) — Número máximo de fotogramas a procesar. 0 significa sin límite y se procesa el vídeo completo.
  • upscale_method (COMBO, por defecto: "lanczos") — Algoritmo de interpolación utilizado al redimensionar fotogramas. Opciones:
    • nearest-exact — Rápido, interpolación del vecino más cercano; puede producir resultados con bloques.
    • bilinear — Suave, bueno para escalado general.
    • area — Redimensionamiento basado en área; efectivo al reducir escala.
    • bicubic — Mayor calidad que bilineal, ligeramente más lento.
    • lanczos — Remuestreo nítido, a menudo preferido para reducción de escala de alta calidad.
  • keep_proportion (COMBO DINÁMICO, Requerido) — Controla cómo manejar la discrepancia de relación de aspecto cuando el ancho/alto objetivo difieren de la relación de aspecto original del fotograma. Es un menú desplegable dinámico que adapta las opciones disponibles según otras entradas; los modos comunes incluyen "crop", "pad", "stretch" o "fit". Consulta las notas de uso para más detalles.

Salidas

  • LATENTE — La representación latente codificada por VAE de todos los fotogramas procesados, apilados como un lote. La forma coincide con las dimensiones latentes esperadas del VAE.
  • AUDIO — La pista de audio extraída del vídeo de entrada, si está presente. Esta salida puede estar vacía o ser None si el vídeo no tiene audio.
  • FLOTANTE — La tasa de fotogramas (FPS) del vídeo original, como un número flotante.
  • ENTERO — El número total de fotogramas realmente procesados (respetando el límite de max_frames).

Notas de Uso

  • El nodo procesa los fotogramas secuencialmente y alimenta cada fotograma redimensionado al VAE inmediatamente, reduciendo significativamente el uso máximo de memoria en comparación con cargar un vídeo completo en un lote de imágenes primero.
  • Establece width y/o height en 0 para preservar la dimensión original. Si ambos son distintos de cero, definen la resolución objetivo. La configuración de keep_proportion determina cómo se resuelven las discrepancias de relación de aspecto.
  • El combo keep_proportion está etiquetado como "Cómo manejar la discrepancia de relación de aspecto al redimensionar" en la información sobre herramientas. Sus opciones exactas dependen de la implementación del nodo (por ejemplo, "crop to fit", "pad", "ignore" o "fit"). Prueba el nodo en tu flujo de trabajo para ver las opciones disponibles.
  • upscale_method solo afecta a los fotogramas que realmente se redimensionan (es decir, cuando el ancho o el alto difiere del original). Si ambas dimensiones coinciden con las originales, no se realiza redimensionamiento y este parámetro se ignora.
  • Usa max_frames para limitar el procesamiento en vídeos largos o para depurar con un subconjunto de fotogramas. Establecer 0 (por defecto) procesa el vídeo completo.
  • La salida LATENTE se puede alimentar directamente a nodos de muestreo (por ejemplo, KSampler) que acepten lotes latentes. El tamaño del lote latente es igual al número de fotogramas.
  • Si el vídeo de entrada no tiene pista de audio, la salida AUDIO será un marcador de posición vacío; los nodos aguas abajo que esperen audio deben manejarlo sin problemas.
  • La salida FLOTANTE (tasa de fotogramas) y la salida ENTERO (número de fotogramas) pueden ser útiles para sincronizar pasos posteriores que dependan del tiempo o para fines de informes.

Comentarios

Inicia sesión con GitHub para unirte a la conversación.

Cargando comentarios…
Codificar Componentes de Vídeo (EncodeVideoComponents) - ComfyUI-KJNodes | ComfyUI Wiki