KJNodes/ltxvgenerated

LTXV Audio Video Mask(LTXVAudioVideoMask)

Crea máscaras de ruido para latentes de vídeo y audio según intervalos de tiempo especificados. El nuevo contenido se genera dentro de estas regiones enmascaradas.

LTXV Audio Video Mask

video_latent
audio_latent
video_latent
audio_latent
video_fps
25.00
video_start_time
0.00
video_end_time
5.00
audio_start_time
0.00
audio_end_time
5.00
max_length
truncate
existing_mask_mode
add
KJNodes

Descripción

Crea máscaras de ruido para latentes de vídeo y audio según intervalos de tiempo especificados. Las máscaras generadas indican qué regiones temporales deben regenerarse durante el muestreo: se produce nuevo contenido dentro de las áreas enmascaradas, mientras que las regiones sin cambios se conservan. Esto es útil para realizar ediciones locales en una secuencia de latente de vídeo o audio, como reemplazar un segmento específico mientras se mantiene el resto intacto.

Entradas

NombreTipoRequeridoPredeterminadoMín / Máx / PasoDescripción
video_latentLATENTNoLatente de vídeo opcional al que se añadirá una máscara de ruido.
audio_latentLATENTNoLatente de audio opcional al que se añadirá una máscara de ruido.
video_fpsFLOAT250 / 100 / 0.01Fotogramas por segundo del latente de vídeo, usado para convertir el tiempo (segundos) a índices de fotograma.
video_start_timeFLOAT00 / 10000 / 0.01Tiempo de inicio en segundos para la máscara de vídeo.
video_end_timeFLOAT50 / 10000 / 0.01Tiempo de fin en segundos para la máscara de vídeo.
audio_start_timeFLOAT00 / 10000 / 0.01Tiempo de inicio en segundos para la máscara de audio.
audio_end_timeFLOAT50 / 10000 / 0.01Tiempo de fin en segundos para la máscara de audio.
max_lengthCOMBOtruncateCómo manejar la longitud total del o los latentes de salida:
truncate – recorta el latente exactamente a la longitud de end_time
pad – extiende el latente hasta end_time si es más corto
partial – crea una máscara para el intervalo de tiempo dentro del latente existente sin cambiar su longitud total
existing_mask_modeCOMBONoaddCómo combinar con cualquier máscara de ruido existente que ya esté presente en el o los latentes de entrada:
add – toma el máximo entre la máscara existente y la nueva (unión)
overwrite – reemplaza completamente la máscara existente con la nueva
subtract – establece la región enmascarada a 0 en lugar de 1, efectivamente desenmascarando esa área

Salidas

TipoDescripción
LATENTLatente de vídeo con una máscara de ruido actualizada (o recién creada) aplicada. Si no se proporcionó video_latent, se devuelve un lote de latentes que contiene solo la máscara (sin muestras).
LATENTLatente de audio con una máscara de ruido actualizada (o recién creada) aplicada. Si no se proporcionó audio_latent, se devuelve un lote de latentes que contiene solo la máscara.

Ambas salidas son diccionarios de latentes estándar de ComfyUI que incluyen una clave noise_mask. La máscara es un tensor binario donde 1 indica las áreas que se regenerarán y 0 indica las áreas que se conservarán.

Notas de uso

  • Al menos uno de video_latent o audio_latent debe estar conectada. Si solo se proporciona uno, solo esa salida correspondiente contendrá datos de muestra significativos; la otra salida será un latente solo de máscara.
  • Los valores de tiempo están en segundos y se convierten a índices de fotograma utilizando el video_fps proporcionado. Esta conversión asume que la dimensión temporal del latente corresponde a (número_de_fotogramas) a la fps dada. Para latentes de audio, se usa el mismo valor de fps para alinear la máscara con la estructura temporal del latente de audio.
  • La configuración max_length determina si el latente de salida se redimensiona (recortado o rellenado) para coincidir con el tiempo final especificado. Con partial, el latente conserva su longitud original y la máscara solo cubre el rango solicitado.
  • Cuando un latente de entrada ya contiene una noise_mask (por ejemplo, de un nodo anterior), existing_mask_mode controla cómo se fusiona la nueva máscara con ella. El valor predeterminado add es útil para acumular regiones de máscara; overwrite reemplaza completamente la máscara; subtract se puede usar para "borrar" áreas previamente enmascaradas.
  • Este nodo está diseñado para usarse con modelos basados en LTXV y pertenece a la categoría KJNodes/ltxv en ComfyUI.

Comentarios

Inicia sesión con GitHub para unirte a la conversación.

Cargando comentarios…
LTXV Audio Video Mask (LTXVAudioVideoMask) - ComfyUI-KJNodes | ComfyUI Wiki