EasyUse/Loadersgenerated

EasyLoader (PixArt)(pixArtLoader)

Le nœud EasyLoader (PixArt) (pixArtLoader) est un chargeur pratique pour les modèles PixArt dans le pack ComfyUI-Easy-Use.

pix Art Loader

optional_lora_stack
pipe
model
vae
ckpt_name
COMBO
model_name
COMBO
vae_name
COMBO
t5_type
COMBO
clip_name
COMBO
padding
1
t5_name
COMBO
device
cpu
dtype
COMBO
lora_name
COMBO
lora_model_strength
1.00
ratio
1
empty_latent_width
INT
empty_latent_height
INT
positive
STRING
negative
STRING
batch_size
1
Easy Use

Le nœud EasyLoader (PixArt) (pixArtLoader) est un chargeur pratique pour les modèles PixArt dans le pack ComfyUI-Easy-Use. Il charge tous les composants nécessaires pour PixArt : le modèle de diffusion (à partir d'un checkpoint ou d'un fichier modèle autonome), le VAE, l'encodeur de texte CLIP et l'encodeur de texte T5 de type SD3. Il construit ensuite le conditionnement des invites à partir des champs de texte positive et negative, crée des latents vides aux dimensions et à la taille de lot demandées, applique les modifications LoRA et regroupe le tout dans un pipeline Easy-Use.

Description

Ce nœud est conçu comme un chargeur tout-en-un pour les flux de travail PixArt. Au lieu d'enchaîner des nœuds séparés pour le checkpoint, le VAE, le CLIP, le T5, le LoRA et les latents vides, vous pouvez utiliser EasyLoader (PixArt) pour préparer un PIPE_LINE complet pour l'échantillonnage. Il expose également les sorties brutes MODEL et VAE si vous devez les connecter ailleurs.

Le nœud attend des invites texte brutes, et non un conditionnement pré-calculé. Les chaînes positive et negative sont encodées en interne à l'aide des encodeurs CLIP et T5 sélectionnés.

Entrées

Entrées requises

  • ckpt_name (COMBO) : sélectionne un fichier checkpoint contenant les poids PixArt. Choisissez le checkpoint qui correspond à vos fichiers de modèles installés.
  • model_name (COMBO) : sélectionne un fichier de modèle de diffusion PixArt autonome. Utilisez soit celui-ci, soit ckpt_name, selon la façon dont vos poids PixArt sont stockés.
  • vae_name (COMBO) : sélectionne le VAE utilisé pour décoder les latents en images.
  • t5_type (COMBO) : type d'encodeur de texte utilisé pour la partie T5 du conditionnement PixArt. Actuellement, la seule option disponible est sd3. PixArt repose sur l'encodeur de texte T5 de type SD3.
  • clip_name (COMBO) : sélectionne l'encodeur de texte CLIP utilisé avec le T5 pour le conditionnement.
  • padding (ENTIER, par défaut 1, plage 1 à 300) : définit la longueur de padding utilisée lors de l'encodage du texte avec l'encodeur de texte T5/SD3. Des valeurs plus élevées ajoutent des jetons de padding autour de l'invite.
  • t5_name (COMBO) : sélectionne le fichier modèle T5 utilisé pour l'encodage du texte.
  • device (COMBO, par défaut cpu) : détermine où les composants chargés s'exécutent. Options :
    • auto : laissez ComfyUI choisir automatiquement le périphérique.
    • cpu : forcez l'exécution sur CPU.
    • gpu : forcez l'exécution sur GPU.
  • dtype (COMBO) : contrôle la précision utilisée pour le modèle chargé. Options :
    • default : utilisez la précision par défaut du modèle.
    • auto (comfy) : laissez ComfyUI décider de la précision appropriée.
    • FP32 : précision float32 complète.
    • FP16 : demi-précision, utile pour réduire l'utilisation de la VRAM.
    • BF16 : précision bfloat16, utile sur le matériel pris en charge.
  • lora_name (COMBO) : sélectionne un fichier LoRA unique à appliquer au modèle PixArt.
  • lora_model_strength (FLOTTANT, par défaut 1, plage -10 à 10, pas 0.01) : contrôle l'intensité avec laquelle le LoRA sélectionné affecte le modèle. Les valeurs négatives sont autorisées.
  • ratio (COMBO, par défaut "1.00") : sélectionne un préréglage de format d'image par nom. La valeur par défaut "1.00" correspond à un format d'image carré 1:1.
  • empty_latent_width (ENTIER) : largeur du latent vide généré en pixels. Aucune valeur par défaut n'est définie, alors spécifiez la largeur souhaitée.
  • empty_latent_height (ENTIER) : hauteur du latent vide généré en pixels. Aucune valeur par défaut n'est définie, alors spécifiez la hauteur souhaitée.
  • positive (CHAÎNE, par défaut "") : invite texte positive utilisée pour le conditionnement.
  • negative (CHAÎNE, par défaut "") : invite texte négative utilisée pour le conditionnement.
  • batch_size (ENTIER, par défaut 1, plage 1 à 64) : nombre d'échantillons latents à créer dans le lot de latents vides.

Entrées facultatives

  • optional_lora_stack (LORA_STACK) : une pile de LoRA supplémentaires à appliquer. C'est utile lorsque vous devez appliquer plus d'un LoRA au modèle, ou lorsque vous utilisez une pile LoRA provenant d'un autre nœud Easy-Use.

Sorties

  • PIPE_LINE : un objet pipeline Easy-Use contenant le modèle chargé, le VAE, le conditionnement, les latents et les autres paramètres nécessaires aux nœuds d'échantillonnage Easy-Use en aval.
  • MODEL : le modèle de diffusion PixArt chargé avec les modifications LoRA appliquées.
  • VAE : le VAE chargé, disponible pour une connexion directe aux nœuds de décodage ou d'échantillonnage.

Remarques d'utilisation

  • Le nœud n'expose pas de sortie CONDITIONING distincte. Le conditionnement est construit en interne à partir de positive et negative et inclus dans le PIPE_LINE.
  • Si vous chargez un modèle avec model_name au lieu de ckpt_name, assurez-vous que vos sélections VAE, CLIP et T5 correspondent aux exigences du modèle.
  • PixArt utilise un encodeur de texte T5 de type SD3, donc t5_type est actuellement fixé à sd3.
  • La valeur padding est appliquée lors de l'encodage du texte T5. Si vous travaillez avec de longues invites, vous devrez peut-être l'augmenter pour éviter de tronquer ou de désaligner les jetons de l'invite.
  • device est défini par défaut sur cpu. Basculez sur gpu ou auto si votre matériel prend en charge un encodage T5/CLIP plus rapide.
  • ratio est un préréglage pratique de format d'image. La résolution réelle des latents de sortie est contrôlée par empty_latent_width et empty_latent_height.
  • Utilisez optional_lora_stack lorsque vous appliquez plusieurs LoRA. Les valeurs d'intensité LoRA peuvent être négatives pour inverser ou réduire l'effet.

Commentaires

Connectez-vous avec GitHub pour rejoindre la discussion.

Chargement des commentaires…