EasyLoader (Kolors): Cargador de modelos Kolors para ComfyUI(kolorsLoader)
Nodo EasyLoader (Kolors) de ComfyUI-Easy-Use. Carga un pipeline de inferencia de Kolors completo: UNet, VAE, codificador de texto ChatGLM3 y LoRA opcional.
kolors Loader
El nodo EasyLoader (Kolors) (kolorsLoader) carga un pipeline de inferencia de Kolors completo en un solo paso: el UNet, el VAE, el codificador de texto ChatGLM3 y una LoRA opcional. Se encuentra en la categoría EasyUse/Loaders. Además de devolver el MODEL y el VAE preparados, también construye un PIPE_LINE que los nodos EasyUse posteriores pueden consumir directamente.
Descripción
Kolors es una familia de modelos de texto a imagen que utiliza ChatGLM3 como codificador de texto en lugar de un codificador estándar basado en CLIP. Este cargador está adaptado a esa arquitectura: carga las piezas del modelo necesarias y construye un pipeline de EasyUse, un modelo y un VAE en un solo nodo. Debido a que ChatGLM3 es necesario para codificar los prompts, el widget chatglm3_name es obligatorio.
Entradas
Requerido
- unet_name (COMBO): Seleccione el archivo UNet de Kolors para cargar.
- vae_name (COMBO): Seleccione el archivo VAE que se usará para decodificar los latent.
- chatglm3_name (COMBO): Seleccione el archivo del codificador de texto ChatGLM3 que se utiliza para codificar
positiveynegative. - lora_name (COMBO): Seleccione una LoRA para aplicar. Las opciones disponibles son los archivos de LoRA conocidos por ComfyUI.
- lora_model_strength (FLOTANTE, default=1, min=-10, max=10, step=0.01): Fuerza aplicada a la LoRA sobre los pesos del modelo de diffusion.
0desactiva el efecto de la LoRA en el lado del modelo; los valores negativos lo invierten. - lora_clip_strength (FLOTANTE, default=1, min=-10, max=10, step=0.01): Fuerza aplicada a la LoRA sobre los pesos del codificador de texto ChatGLM3.
0desactiva el efecto de la LoRA en el lado del codificador de texto; los valores negativos lo invierten. - resolution (COMBO, default="1024 x 576"): Un atajo preestablecido que establece
empty_latent_widthyempty_latent_heighten valores estándar. Aún se pueden ingresar dimensiones personalizadas manualmente después de seleccionar un preestablecido. - empty_latent_width (ENTERO): Ancho del latent vacío que se creará. Normalmente lo establece el combo
resolution, pero se puede sobrescribir para tamaños personalizados. - empty_latent_height (ENTERO): Alto del latent vacío que se creará. Normalmente lo establece el combo
resolution, pero se puede sobrescribir para tamaños personalizados. - positive (CADENA, default=""): El texto del prompt positivo. Se codifica con el codificador de texto ChatGLM3 seleccionado.
- negative (CADENA, default=""): El texto del prompt negativo. Se codifica con el codificador de texto ChatGLM3 seleccionado.
- batch_size (ENTERO, default=1, min=1, max=64): Número de latent a crear en el pipeline. Los valores más altos usan más VRAM.
Opcional
- model_override (MODEL): Si se conecta, el nodo usa este modelo en lugar de cargar un UNet desde
unet_name. - vae_override (VAE): Si se conecta, el nodo usa este VAE en lugar de cargar uno desde
vae_name. - optional_lora_stack (LORA_STACK): Conecte aquí un LoRA stack para aplicar múltiples LoRA junto con la selección principal de
lora_name. - auto_clean_gpu (BOOLEANO, default=false): Actívelo para intentar una limpieza automática de la GPU después de la carga, lo que puede reducir la presión sobre la VRAM al cambiar de modelo con frecuencia. Desactívelo cuando quiera mantener el modelo cargado en caché en memoria para muestreos repetidos.
Salidas
- PIPE_LINE: Un objeto de pipeline de EasyUse que contiene el modelo cargado, el VAE, los prompts, el ancho/alto latent y el tamaño del lote. Conéctelo a nodos EasyUse compatibles con pipeline para el muestreo.
- MODEL: El modelo efectivo después de cargar y aplicar la LoRA seleccionada, el LoRA stack o la anulación de modelo. Úselo con los nodos de muestreo estándar de ComfyUI.
- VAE: El VAE efectivo después de cargar y aplicar cualquier anulación de VAE. Úselo para decodificar los latent en imágenes.
Notas de uso
- Kolors utiliza ChatGLM3 en lugar de los codificadores de texto CLIP habituales. Para cambiar el codificador de prompts, use
chatglm3_name. - El menú
resolutiones una forma cómoda de establecerempty_latent_widthyempty_latent_height. Seleccionar un preestablecido sobrescribe esos campos, así que ingrese valores personalizados después si necesita una relación de aspecto diferente. Mantenga las dimensiones compatibles con el formato latent. Normalmente se requieren múltiplos de 8 o 16. - Las fuerzas de LoRA son independientes:
lora_model_strengthafecta los pesos del modelo de diffusion, mientras quelora_clip_strengthafecta los pesos del codificador de texto ChatGLM3. Un valor de0desactiva ese lado de la LoRA, y el widget acepta valores negativos. - Si necesita múltiples LoRA, conecte
optional_lora_stack; la LoRA principal delora_namese sigue aplicando a menos que sus fuerzas estén establecidas en0o se seleccione una entrada sin efecto (no-op). - Use
model_overrideyvae_overridecuando ya tenga un modelo o VAE cargado en otra parte del gráfico. Esto evita volver a cargar los mismos archivos desde el disco y le permite reutilizar recursos en múltiples configuraciones de cargadores.
Comentarios
Inicia sesión con GitHub para unirte a la conversación.