EasyUse/Loadersgenerated

EasyLoader (Kolors)(kolorsLoader)

Le nœud EasyLoader (Kolors) (kolorsLoader) charge un pipeline d'inférence Kolors complet en une seule étape : l'UNet, le VAE, l'encodeur de texte ChatGLM3 et un LoRA facultatif.

kolors Loader

model_override
vae_override
optional_lora_stack
pipe
model
vae
unet_name
COMBO
vae_name
COMBO
chatglm3_name
COMBO
lora_name
COMBO
lora_model_strength
1.00
lora_clip_strength
1.00
resolution
1024 x 576
empty_latent_width
INT
empty_latent_height
INT
positive
STRING
negative
STRING
batch_size
1
auto_clean_gpu
Easy Use

Le nœud EasyLoader (Kolors) (kolorsLoader) charge un pipeline d'inférence Kolors complet en une seule étape : l'UNet, le VAE, l'encodeur de texte ChatGLM3 et un LoRA facultatif. Il est répertorié dans la catégorie EasyUse/Loaders. En plus de renvoyer le MODEL et le VAE préparés, il construit également un PIPE_LINE que les nœuds EasyUse en aval peuvent consommer directement.

Description

Kolors est une famille de modèles texte-vers-image qui utilise ChatGLM3 comme encodeur de texte au lieu d'un encodeur standard basé sur CLIP. Ce chargeur est adapté à cette architecture : il charge les composants de modèle requis et construit un pipeline EasyUse, un modèle et un VAE en un seul nœud. Étant donné que ChatGLM3 est requis pour l'encodage des invites, le widget chatglm3_name est obligatoire.

Entrées

Requis

  • unet_name (COMBO) : Sélectionnez le fichier UNet Kolors à charger.
  • vae_name (COMBO) : Sélectionnez le fichier VAE à utiliser pour décoder les latents.
  • chatglm3_name (COMBO) : Sélectionnez le fichier d'encodeur de texte ChatGLM3 utilisé pour encoder positive et negative.
  • lora_name (COMBO) : Sélectionnez un LoRA à appliquer. Les options disponibles sont les fichiers LoRA connus de ComfyUI.
  • lora_model_strength (FLOTTANT, défaut=1, min=-10, max=10, pas=0,01) : Force appliquée au LoRA sur les poids du modèle de diffusion. 0 désactive l'effet LoRA côté modèle ; les valeurs négatives l'inversent.
  • lora_clip_strength (FLOTTANT, défaut=1, min=-10, max=10, pas=0,01) : Force appliquée au LoRA sur les poids de l'encodeur de texte ChatGLM3. 0 désactive l'effet LoRA côté encodeur de texte ; les valeurs négatives l'inversent.
  • resolution (COMBO, défaut="1024 x 576") : Un raccourci prédéfini qui définit empty_latent_width et empty_latent_height sur des valeurs standard. Des dimensions personnalisées peuvent toujours être saisies manuellement après la sélection d'un préréglage.
  • empty_latent_width (ENTIER) : Largeur du latent vide à créer. Elle est généralement définie par le menu déroulant resolution, mais peut être remplacée pour des tailles personnalisées.
  • empty_latent_height (ENTIER) : Hauteur du latent vide à créer. Elle est généralement définie par le menu déroulant resolution, mais peut être remplacée pour des tailles personnalisées.
  • positive (CHAÎNE, défaut="") : Le texte de l'invite positive. Il est encodé à l'aide de l'encodeur de texte ChatGLM3 sélectionné.
  • negative (CHAÎNE, défaut="") : Le texte de l'invite négative. Il est encodé à l'aide de l'encodeur de texte ChatGLM3 sélectionné.
  • batch_size (ENTIER, défaut=1, min=1, max=64) : Nombre de latents à créer dans le pipeline. Des valeurs plus élevées utilisent plus de VRAM.

Facultatif

  • model_override (MODEL) : Lorsqu'il est connecté, le nœud utilise ce modèle au lieu de charger un UNet depuis unet_name.
  • vae_override (VAE) : Lorsqu'il est connecté, le nœud utilise ce VAE au lieu d'en charger un depuis vae_name.
  • optional_lora_stack (LORA_STACK) : Connectez une pile de LoRA ici pour appliquer plusieurs LoRA en plus de la sélection principale lora_name.
  • auto_clean_gpu (BOOLÉEN, défaut=faux) : Activez pour tenter un nettoyage automatique du GPU après le chargement, ce qui peut réduire la pression sur la VRAM lors de changements fréquents de modèles. Désactivez-le lorsque vous souhaitez conserver le modèle chargé en cache en mémoire pour des échantillonnages répétés.

Sorties

  • PIPE_LINE : Un objet pipeline EasyUse contenant le modèle chargé, le VAE, les invites, la largeur/hauteur du latent et la taille du lot. Connectez-le aux nœuds EasyUse compatibles pipeline pour l'échantillonnage.
  • MODEL : Le modèle effectif après chargement et application du LoRA / de la pile de LoRA / de la substitution de modèle sélectionnés. Utilisez-le avec les nœuds d'échantillonnage ComfyUI standard.
  • VAE : Le VAE effectif après chargement et application de toute substitution de VAE. Utilisez-le pour décoder les latents en images.

Notes d'utilisation

  • Kolors utilise ChatGLM3 plutôt que les encodeurs de texte CLIP habituels. Pour changer l'encodeur d'invite, utilisez chatglm3_name.
  • Le menu resolution est un outil pratique pour définir empty_latent_width et empty_latent_height. La sélection d'un préréglage écrase ces champs, alors saisissez des valeurs personnalisées ensuite si vous avez besoin d'un ratio différent. Gardez les dimensions compatibles avec le format latent : les multiples de 8 ou 16 sont généralement requis.
  • Les forces du LoRA sont indépendantes : lora_model_strength affecte les poids du modèle de diffusion, tandis que lora_clip_strength affecte les poids de l'encodeur de texte ChatGLM3. Une valeur de 0 désactive ce côté du LoRA, et les valeurs négatives sont acceptées par le widget.
  • Si vous avez besoin de plusieurs LoRA, connectez optional_lora_stack ; le LoRA principal lora_name est toujours appliqué, sauf si ses forces sont définies sur 0 ou si une entrée sans effet est sélectionnée.
  • Utilisez model_override et vae_override lorsque vous avez déjà un modèle ou un VAE chargé ailleurs dans le graphique. Cela évite de recharger les mêmes fichiers depuis le disque et vous permet de réutiliser les ressources sur plusieurs configurations de chargeur.

Commentaires

Connectez-vous avec GitHub pour rejoindre la discussion.

Chargement des commentaires…