EasyLoader (PixArt)(pixArtLoader)
El nodo EasyLoader (PixArt) (pixArtLoader) es un cargador de conveniencia para modelos PixArt en el paquete ComfyUI-Easy-Use.
pix Art Loader
El nodo EasyLoader (PixArt) (pixArtLoader) es un cargador de conveniencia para los modelos PixArt del paquete ComfyUI-Easy-Use. Carga todos los componentes necesarios para PixArt (el modelo de difusión, desde un checkpoint o un archivo de modelo independiente, el VAE, el codificador de texto CLIP y el codificador de texto T5 estilo SD3) y luego construye el acondicionamiento a partir de los campos de texto positive y negative, crea latentes vacíos en las dimensiones y el tamaño de lote solicitados, aplica las modificaciones LoRA y empaqueta todo en una pipeline de Easy-Use.
Descripción
Este nodo está diseñado como un cargador integral para flujos de trabajo de PixArt. En lugar de encadenar nodos separados de checkpoint, VAE, CLIP, T5, LoRA y latente vacío, puedes usar EasyLoader (PixArt) para preparar un PIPE_LINE completo para el muestreo. También expone las salidas sin procesar de MODEL y VAE si necesitas conectarlas en otro lugar.
El nodo espera prompts de texto sin procesar, no acondicionamiento precalculado. Las cadenas positive y negative se codifican internamente utilizando los codificadores CLIP y T5 seleccionados.
Entradas
Entradas requeridas
- ckpt_name (
COMBO): Selecciona un archivo de checkpoint que contenga los pesos de PixArt. Elige el checkpoint que coincida con tus archivos de modelo instalados. - model_name (
COMBO): Selecciona un archivo de modelo de difusión PixArt independiente. Usa este ockpt_name, dependiendo de cómo estén almacenados tus pesos de PixArt. - vae_name (
COMBO): Selecciona el VAE utilizado para decodificar los latentes en imágenes. - t5_type (
COMBO): Tipo de codificador de texto utilizado para la parte T5 del acondicionamiento de PixArt. Actualmente la única opción disponible essd3; PixArt depende del codificador de texto T5 estilo SD3. - clip_name (
COMBO): Selecciona el codificador de texto CLIP utilizado junto con T5 para el acondicionamiento. - padding (
INT, por defecto1, rango1–300): Establece la longitud de padding utilizada al codificar texto con el codificador de texto T5/SD3. Los valores más altos añaden tokens de padding alrededor del prompt. - t5_name (
COMBO): Selecciona el archivo de modelo T5 utilizado para la codificación de texto. - device (
COMBO, por defectocpu): Determina dónde se ejecutan los componentes cargados. Opciones:auto: permite que ComfyUI elija el dispositivo automáticamente.cpu: fuerza la ejecución en CPU.gpu: fuerza la ejecución en GPU.
- dtype (
COMBO): Controla la precisión utilizada para el modelo cargado. Opciones:default: usa la precisión predeterminada del modelo.auto (comfy): permite que ComfyUI decida la precisión adecuada.FP32: precisión completa float32.FP16: media precisión, útil para reducir el uso de VRAM.BF16: precisión bfloat16, útil en hardware compatible.
- lora_name (
COMBO): Selecciona un único archivo LoRA para aplicar al modelo PixArt. - lora_model_strength (
FLOAT, por defecto1, rango-10a10, paso0.01): Controla la intensidad con la que el LoRA seleccionado afecta al modelo. Se permiten valores negativos. - ratio (
COMBO, por defecto"1.00"): Selecciona un preajuste de relación de aspecto por nombre. El valor predeterminado"1.00"corresponde a una relación de aspecto cuadrada 1:1. - empty_latent_width (
INT): Ancho del latente vacío generado en píxeles. No se establece un valor predeterminado, por lo que debes especificar el ancho deseado. - empty_latent_height (
INT): Alto del latente vacío generado en píxeles. No se establece un valor predeterminado, por lo que debes especificar el alto deseado. - positive (
STRING, por defecto""): Prompt de texto positivo utilizado para el acondicionamiento. - negative (
STRING, por defecto""): Prompt de texto negativo utilizado para el acondicionamiento. - batch_size (
INT, por defecto1, rango1–64): Número de muestras latentes para crear en el lote de latentes vacíos.
Entradas opcionales
- optional_lora_stack (
LORA_STACK): Una pila de LoRAs adicionales para aplicar. Esto es útil cuando necesitas aplicar más de un LoRA al modelo, o cuando usas una pila de LoRAs de otro nodo de Easy-Use.
Salidas
- PIPE_LINE: Un objeto de pipeline de Easy-Use que contiene el modelo cargado, el VAE, el acondicionamiento, los latentes y otras configuraciones necesarias para los nodos muestreadores de Easy-Use posteriores.
- MODEL: El modelo de difusión PixART cargado con los cambios LoRA aplicados.
- VAE: El VAE cargado, disponible para conexión directa a nodos de decodificador o muestreadores.
Notas de uso
- Este nodo no expone una salida
CONDITIONINGseparada. El acondicionamiento se construye internamente a partir depositiveynegativey se incluye en elPIPE_LINE. - Si cargas un modelo usando
model_nameen lugar deckpt_name, asegúrate de que tus selecciones de VAE, CLIP y T5 coincidan con los requisitos del modelo. - PixArt utiliza un codificador de texto T5 estilo SD3, por lo que
t5_typeestá actualmente fijado asd3. - El valor
paddingse aplica durante la codificación de texto con T5. Si trabajas con prompts largos, es posible que necesites aumentarlo para evitar truncar o desalinear los tokens del prompt. deviceusacpupor defecto; cambia agpuoautosi tu hardware admite una codificación T5/CLIP más rápida.ratioes un preajuste de relación de aspecto de conveniencia. La resolución real de los latentes de salida se controla medianteempty_latent_widthyempty_latent_height.- Usa
optional_lora_stackcuando apliques múltiples LoRAs; los valores de fuerza del LoRA pueden ser negativos para invertir o reducir el efecto.
Comentarios
Inicia sesión con GitHub para unirte a la conversación.