KJNodes/ltxvgenerated

LTXV Audio Video Mask(LTXVAudioVideoMask)

Creates noise masks for video and audio latents based on specified time ranges. New content is generated within these masked regions

LTXV Audio Video Mask

video_latent
audio_latent
video_latent
audio_latent
video_fps
25.00
video_start_time
0.00
video_end_time
5.00
audio_start_time
0.00
audio_end_time
5.00
max_length
truncate
existing_mask_mode
add
KJNodes
## Description

Crée des masques de bruit pour les latents vidéo et audio en fonction de plages de temps spécifiées. Les masques générés indiquent quelles régions temporelles doivent être régénérées pendant l'échantillonnage : un nouveau contenu est produit dans les zones masquées tandis que les régions inchangées sont préservées. Ceci est utile pour effectuer des modifications locales sur une séquence de latent vidéo ou audio, comme remplacer un segment spécifique tout en conservant le reste intact.

## Entrées

| Nom | Type | Requis | Défaut | Min / Max / Pas | Description |
|---|---|---|---|---|---|
| `video_latent` | `LATENT` | Non | – | – | Latent vidéo optionnel auquel un masque de bruit sera ajouté. |
| `audio_latent` | `LATENT` | Non | – | – | Latent audio optionnel auquel un masque de bruit sera ajouté. |
| `video_fps` | `FLOTTANT` | Oui | 25 | 0 / 100 / 0.01 | Taux d'images du latent vidéo, utilisé pour convertir le temps (secondes) en indices d'images. |
| `video_start_time` | `FLOTTANT` | Oui | 0 | 0 / 10000 / 0.01 | Temps de début en secondes pour le masque vidéo. |
| `video_end_time` | `FLOTTANT` | Oui | 5 | 0 / 10000 / 0.01 | Temps de fin en secondes pour le masque vidéo. |
| `audio_start_time` | `FLOTTANT` | Oui | 0 | 0 / 10000 / 0.01 | Temps de début en secondes pour le masque audio. |
| `audio_end_time` | `FLOTTANT` | Oui | 5 | 0 / 10000 / 0.01 | Temps de fin en secondes pour le masque audio. |
| `max_length` | `COMBO` | Oui | `truncate` | – | Comment gérer la longueur totale du ou des latents de sortie :<br>• `truncate` – coupe le latent exactement à la longueur `end_time`<br>• `pad` – étend le latent jusqu'à `end_time` s'il est plus court<br>• `partial` – crée un masque pour la plage de temps dans le latent existant sans modifier sa longueur totale |
| `existing_mask_mode` | `COMBO` | Non | `add` | – | Comment combiner avec tout masque de bruit existant déjà présent dans le ou les latents d'entrée :<br>• `add` – prend le maximum du masque existant et du nouveau (union)<br>• `overwrite` – remplace entièrement le masque existant par le nouveau<br>• `subtract` – définit la région masquée à 0 au lieu de 1, démasquant ainsi cette zone |

## Sorties

| Type | Description |
|---|---|
| `LATENT` | Latent vidéo avec un masque de bruit mis à jour (ou un masque nouvellement créé) appliqué. Si aucun `video_latent` n'a été fourni, un lot de latents contenant uniquement le masque (aucun échantillon) est renvoyé. |
| `LATENT` | Latent audio avec un masque de bruit mis à jour (ou un masque nouvellement créé) appliqué. Si aucun `audio_latent` n'a été fourni, un lot de latents contenant uniquement le masque est renvoyé. |

Les deux sorties sont des dictionnaires de latents standard de ComfyUI qui incluent une clé `noise_mask`. Le masque est un tenseur binaire où `1` indique les zones à régénérer et `0` indique les zones à préserver.

## Remarques d'utilisation

- Au moins un des `video_latent` ou `audio_latent` doit être connecté. Si un seul est fourni, seule la sortie correspondante contiendra des données d'échantillon significatives ; l'autre sortie sera un latent contenant uniquement le masque.
- Les valeurs de temps sont en secondes et sont converties en indices d'images en utilisant le `video_fps` fourni. Cette conversion suppose que la dimension temporelle du latent correspond au (nombre_d'images) à la cadence d'images donnée. Pour les latents audio, la même valeur de fps est utilisée pour aligner le masque sur la structure temporelle du latent audio.
- Le paramètre `max_length` détermine si le latent de sortie est redimensionné (tronqué ou étendu) pour correspondre au temps de fin spécifié. Avec `partial`, le latent conserve sa longueur d'origine et le masque ne couvre que la plage demandée.
- Lorsqu'un latent d'entrée contient déjà un `noise_mask` (par exemple, d'un nœud précédent), `existing_mask_mode` contrôle comment le nouveau masque se fusionne avec lui. Le mode par défaut `add` est utile pour accumuler des régions de masque ; `overwrite` remplace entièrement le masque ; `subtract` peut être utilisé pour « effacer » les zones précédemment masquées.
- Ce nœud est destiné à être utilisé avec les modèles basés sur LTXV et appartient à la catégorie `KJNodes/ltxv` dans ComfyUI.

Commentaires

Connectez-vous avec GitHub pour rejoindre la discussion.

Chargement des commentaires…
LTXV Audio Video Mask (LTXVAudioVideoMask) - ComfyUI-KJNodes | ComfyUI Wiki