EasyLoader (PixArt)(pixArtLoader)
Le nœud EasyLoader (PixArt) (pixArtLoader) est un chargeur pratique pour les modèles PixArt dans le pack ComfyUI-Easy-Use.
pix Art Loader
Le nœud EasyLoader (PixArt) (pixArtLoader) est un chargeur pratique pour les modèles PixArt dans le pack ComfyUI-Easy-Use. Il charge tous les composants nécessaires pour PixArt : le modèle de diffusion (à partir d'un checkpoint ou d'un fichier modèle autonome), le VAE, l'encodeur de texte CLIP et l'encodeur de texte T5 de type SD3. Il construit ensuite le conditionnement des invites à partir des champs de texte positive et negative, crée des latents vides aux dimensions et à la taille de lot demandées, applique les modifications LoRA et regroupe le tout dans un pipeline Easy-Use.
Description
Ce nœud est conçu comme un chargeur tout-en-un pour les flux de travail PixArt. Au lieu d'enchaîner des nœuds séparés pour le checkpoint, le VAE, le CLIP, le T5, le LoRA et les latents vides, vous pouvez utiliser EasyLoader (PixArt) pour préparer un PIPE_LINE complet pour l'échantillonnage. Il expose également les sorties brutes MODEL et VAE si vous devez les connecter ailleurs.
Le nœud attend des invites texte brutes, et non un conditionnement pré-calculé. Les chaînes positive et negative sont encodées en interne à l'aide des encodeurs CLIP et T5 sélectionnés.
Entrées
Entrées requises
- ckpt_name (
COMBO) : sélectionne un fichier checkpoint contenant les poids PixArt. Choisissez le checkpoint qui correspond à vos fichiers de modèles installés. - model_name (
COMBO) : sélectionne un fichier de modèle de diffusion PixArt autonome. Utilisez soit celui-ci, soitckpt_name, selon la façon dont vos poids PixArt sont stockés. - vae_name (
COMBO) : sélectionne le VAE utilisé pour décoder les latents en images. - t5_type (
COMBO) : type d'encodeur de texte utilisé pour la partie T5 du conditionnement PixArt. Actuellement, la seule option disponible estsd3. PixArt repose sur l'encodeur de texte T5 de type SD3. - clip_name (
COMBO) : sélectionne l'encodeur de texte CLIP utilisé avec le T5 pour le conditionnement. - padding (
ENTIER, par défaut1, plage1à300) : définit la longueur de padding utilisée lors de l'encodage du texte avec l'encodeur de texte T5/SD3. Des valeurs plus élevées ajoutent des jetons de padding autour de l'invite. - t5_name (
COMBO) : sélectionne le fichier modèle T5 utilisé pour l'encodage du texte. - device (
COMBO, par défautcpu) : détermine où les composants chargés s'exécutent. Options :auto: laissez ComfyUI choisir automatiquement le périphérique.cpu: forcez l'exécution sur CPU.gpu: forcez l'exécution sur GPU.
- dtype (
COMBO) : contrôle la précision utilisée pour le modèle chargé. Options :default: utilisez la précision par défaut du modèle.auto (comfy): laissez ComfyUI décider de la précision appropriée.FP32: précision float32 complète.FP16: demi-précision, utile pour réduire l'utilisation de la VRAM.BF16: précision bfloat16, utile sur le matériel pris en charge.
- lora_name (
COMBO) : sélectionne un fichier LoRA unique à appliquer au modèle PixArt. - lora_model_strength (
FLOTTANT, par défaut1, plage-10à10, pas0.01) : contrôle l'intensité avec laquelle le LoRA sélectionné affecte le modèle. Les valeurs négatives sont autorisées. - ratio (
COMBO, par défaut"1.00") : sélectionne un préréglage de format d'image par nom. La valeur par défaut"1.00"correspond à un format d'image carré 1:1. - empty_latent_width (
ENTIER) : largeur du latent vide généré en pixels. Aucune valeur par défaut n'est définie, alors spécifiez la largeur souhaitée. - empty_latent_height (
ENTIER) : hauteur du latent vide généré en pixels. Aucune valeur par défaut n'est définie, alors spécifiez la hauteur souhaitée. - positive (
CHAÎNE, par défaut"") : invite texte positive utilisée pour le conditionnement. - negative (
CHAÎNE, par défaut"") : invite texte négative utilisée pour le conditionnement. - batch_size (
ENTIER, par défaut1, plage1à64) : nombre d'échantillons latents à créer dans le lot de latents vides.
Entrées facultatives
- optional_lora_stack (
LORA_STACK) : une pile de LoRA supplémentaires à appliquer. C'est utile lorsque vous devez appliquer plus d'un LoRA au modèle, ou lorsque vous utilisez une pile LoRA provenant d'un autre nœud Easy-Use.
Sorties
- PIPE_LINE : un objet pipeline Easy-Use contenant le modèle chargé, le VAE, le conditionnement, les latents et les autres paramètres nécessaires aux nœuds d'échantillonnage Easy-Use en aval.
- MODEL : le modèle de diffusion PixArt chargé avec les modifications LoRA appliquées.
- VAE : le VAE chargé, disponible pour une connexion directe aux nœuds de décodage ou d'échantillonnage.
Remarques d'utilisation
- Le nœud n'expose pas de sortie
CONDITIONINGdistincte. Le conditionnement est construit en interne à partir depositiveetnegativeet inclus dans lePIPE_LINE. - Si vous chargez un modèle avec
model_nameau lieu deckpt_name, assurez-vous que vos sélections VAE, CLIP et T5 correspondent aux exigences du modèle. - PixArt utilise un encodeur de texte T5 de type SD3, donc
t5_typeest actuellement fixé àsd3. - La valeur
paddingest appliquée lors de l'encodage du texte T5. Si vous travaillez avec de longues invites, vous devrez peut-être l'augmenter pour éviter de tronquer ou de désaligner les jetons de l'invite. deviceest défini par défaut surcpu. Basculez surgpuouautosi votre matériel prend en charge un encodage T5/CLIP plus rapide.ratioest un préréglage pratique de format d'image. La résolution réelle des latents de sortie est contrôlée parempty_latent_widthetempty_latent_height.- Utilisez
optional_lora_stacklorsque vous appliquez plusieurs LoRA. Les valeurs d'intensité LoRA peuvent être négatives pour inverser ou réduire l'effet.
Commentaires
Connectez-vous avec GitHub pour rejoindre la discussion.