EasyUse/Loadersgenerated

EasyLoader (PixArt)(pixArtLoader)

El nodo EasyLoader (PixArt) (pixArtLoader) es un cargador de conveniencia para modelos PixArt en el paquete ComfyUI-Easy-Use.

pix Art Loader

optional_lora_stack
pipe
model
vae
ckpt_name
COMBO
model_name
COMBO
vae_name
COMBO
t5_type
COMBO
clip_name
COMBO
padding
1
t5_name
COMBO
device
cpu
dtype
COMBO
lora_name
COMBO
lora_model_strength
1.00
ratio
1
empty_latent_width
INT
empty_latent_height
INT
positive
STRING
negative
STRING
batch_size
1
Easy Use

El nodo EasyLoader (PixArt) (pixArtLoader) es un cargador de conveniencia para los modelos PixArt del paquete ComfyUI-Easy-Use. Carga todos los componentes necesarios para PixArt (el modelo de difusión, desde un checkpoint o un archivo de modelo independiente, el VAE, el codificador de texto CLIP y el codificador de texto T5 estilo SD3) y luego construye el acondicionamiento a partir de los campos de texto positive y negative, crea latentes vacíos en las dimensiones y el tamaño de lote solicitados, aplica las modificaciones LoRA y empaqueta todo en una pipeline de Easy-Use.

Descripción

Este nodo está diseñado como un cargador integral para flujos de trabajo de PixArt. En lugar de encadenar nodos separados de checkpoint, VAE, CLIP, T5, LoRA y latente vacío, puedes usar EasyLoader (PixArt) para preparar un PIPE_LINE completo para el muestreo. También expone las salidas sin procesar de MODEL y VAE si necesitas conectarlas en otro lugar.

El nodo espera prompts de texto sin procesar, no acondicionamiento precalculado. Las cadenas positive y negative se codifican internamente utilizando los codificadores CLIP y T5 seleccionados.

Entradas

Entradas requeridas

  • ckpt_name (COMBO): Selecciona un archivo de checkpoint que contenga los pesos de PixArt. Elige el checkpoint que coincida con tus archivos de modelo instalados.
  • model_name (COMBO): Selecciona un archivo de modelo de difusión PixArt independiente. Usa este o ckpt_name, dependiendo de cómo estén almacenados tus pesos de PixArt.
  • vae_name (COMBO): Selecciona el VAE utilizado para decodificar los latentes en imágenes.
  • t5_type (COMBO): Tipo de codificador de texto utilizado para la parte T5 del acondicionamiento de PixArt. Actualmente la única opción disponible es sd3; PixArt depende del codificador de texto T5 estilo SD3.
  • clip_name (COMBO): Selecciona el codificador de texto CLIP utilizado junto con T5 para el acondicionamiento.
  • padding (INT, por defecto 1, rango 1300): Establece la longitud de padding utilizada al codificar texto con el codificador de texto T5/SD3. Los valores más altos añaden tokens de padding alrededor del prompt.
  • t5_name (COMBO): Selecciona el archivo de modelo T5 utilizado para la codificación de texto.
  • device (COMBO, por defecto cpu): Determina dónde se ejecutan los componentes cargados. Opciones:
    • auto: permite que ComfyUI elija el dispositivo automáticamente.
    • cpu: fuerza la ejecución en CPU.
    • gpu: fuerza la ejecución en GPU.
  • dtype (COMBO): Controla la precisión utilizada para el modelo cargado. Opciones:
    • default: usa la precisión predeterminada del modelo.
    • auto (comfy): permite que ComfyUI decida la precisión adecuada.
    • FP32: precisión completa float32.
    • FP16: media precisión, útil para reducir el uso de VRAM.
    • BF16: precisión bfloat16, útil en hardware compatible.
  • lora_name (COMBO): Selecciona un único archivo LoRA para aplicar al modelo PixArt.
  • lora_model_strength (FLOAT, por defecto 1, rango -10 a 10, paso 0.01): Controla la intensidad con la que el LoRA seleccionado afecta al modelo. Se permiten valores negativos.
  • ratio (COMBO, por defecto "1.00"): Selecciona un preajuste de relación de aspecto por nombre. El valor predeterminado "1.00" corresponde a una relación de aspecto cuadrada 1:1.
  • empty_latent_width (INT): Ancho del latente vacío generado en píxeles. No se establece un valor predeterminado, por lo que debes especificar el ancho deseado.
  • empty_latent_height (INT): Alto del latente vacío generado en píxeles. No se establece un valor predeterminado, por lo que debes especificar el alto deseado.
  • positive (STRING, por defecto ""): Prompt de texto positivo utilizado para el acondicionamiento.
  • negative (STRING, por defecto ""): Prompt de texto negativo utilizado para el acondicionamiento.
  • batch_size (INT, por defecto 1, rango 164): Número de muestras latentes para crear en el lote de latentes vacíos.

Entradas opcionales

  • optional_lora_stack (LORA_STACK): Una pila de LoRAs adicionales para aplicar. Esto es útil cuando necesitas aplicar más de un LoRA al modelo, o cuando usas una pila de LoRAs de otro nodo de Easy-Use.

Salidas

  • PIPE_LINE: Un objeto de pipeline de Easy-Use que contiene el modelo cargado, el VAE, el acondicionamiento, los latentes y otras configuraciones necesarias para los nodos muestreadores de Easy-Use posteriores.
  • MODEL: El modelo de difusión PixART cargado con los cambios LoRA aplicados.
  • VAE: El VAE cargado, disponible para conexión directa a nodos de decodificador o muestreadores.

Notas de uso

  • Este nodo no expone una salida CONDITIONING separada. El acondicionamiento se construye internamente a partir de positive y negative y se incluye en el PIPE_LINE.
  • Si cargas un modelo usando model_name en lugar de ckpt_name, asegúrate de que tus selecciones de VAE, CLIP y T5 coincidan con los requisitos del modelo.
  • PixArt utiliza un codificador de texto T5 estilo SD3, por lo que t5_type está actualmente fijado a sd3.
  • El valor padding se aplica durante la codificación de texto con T5. Si trabajas con prompts largos, es posible que necesites aumentarlo para evitar truncar o desalinear los tokens del prompt.
  • device usa cpu por defecto; cambia a gpu o auto si tu hardware admite una codificación T5/CLIP más rápida.
  • ratio es un preajuste de relación de aspecto de conveniencia. La resolución real de los latentes de salida se controla mediante empty_latent_width y empty_latent_height.
  • Usa optional_lora_stack cuando apliques múltiples LoRAs; los valores de fuerza del LoRA pueden ser negativos para invertir o reducir el efecto.

Comentarios

Inicia sesión con GitHub para unirte a la conversación.

Cargando comentarios…