EasyUse/Loadersgenerated

EasyLoader (PixArt)(pixArtLoader)

EasyLoader (PixArt) 节点(pixArtLoader)是 ComfyUI-Easy-Use 包中用于 PixArt 模型的便捷加载器。

pix Art Loader

optional_lora_stack
pipe
model
vae
ckpt_name
COMBO
model_name
COMBO
vae_name
COMBO
t5_type
COMBO
clip_name
COMBO
padding
1
t5_name
COMBO
device
cpu
dtype
COMBO
lora_name
COMBO
lora_model_strength
1.00
ratio
1
empty_latent_width
INT
empty_latent_height
INT
positive
STRING
negative
STRING
batch_size
1
Easy Use

ComfyUI-Easy-Use 包中的 EasyLoader (PixArt) 节点(pixArtLoader)是一个用于 PixArt 模型的便捷加载器。它会加载 PixArt 所需的全部组件:扩散模型(来自 checkpoint 或独立模型文件)、VAE、CLIP 文本编码器和 SD3 风格的 T5 文本编码器,然后根据 positivenegative 文本字段构建提示词条件,按所需尺寸和批处理大小创建空 Latent,应用 LoRA 修改,并将所有内容打包到 Easy-Use pipeline 中。

描述

此节点旨在成为 PixArt 工作流的一站式加载器。无需串联单独的 checkpoint、VAE、CLIP、T5、LoRA 和空 Latent 节点,您可以使用 EasyLoader (PixArt) 准备完整的 PIPE_LINE 进行采样。如果您需要将原始 MODELVAE 输出连接到其他地方,此节点也会将它们单独暴露出来。

此节点期望的是原始文本提示词,而非预先计算好的条件。positivenegative 字符串会在内部使用已选择的 CLIP 和 T5 编码器进行编码。

输入

必填输入

  • ckpt_name (COMBO):选择包含 PixArt 权重的 checkpoint 文件。请选择与您已安装的模型文件相匹配的 checkpoint。
  • model_name (COMBO):选择独立的 PixArt 扩散模型文件。根据您 PixArt 权重的存储方式,使用此选项或 ckpt_name
  • vae_name (COMBO):选择用于将 Latent 解码为图像的 VAE。
  • t5_type (COMBO):用于 PixArt 条件中 T5 部分的文本编码器类型。目前唯一可用的选项是 sd3;PixArt 依赖 SD3 风格的 T5 文本编码器。
  • clip_name (COMBO):选择与 T5 一起用于条件的 CLIP 文本编码器。
  • padding (INT,默认 1,范围 1300):设置使用 T5/SD3 文本编码器对文本进行编码时应用的填充长度。较高的值会在提示词周围添加更多填充标记。
  • t5_name (COMBO):选择用于文本编码的 T5 模型文件。
  • device (COMBO,默认 cpu):决定已加载组件在何处运行。选项:
    • auto:让 ComfyUI 自动选择设备。
    • cpu:强制使用 CPU 执行。
    • gpu:强制使用 GPU 执行。
  • dtype (COMBO):控制已加载模型使用的精度。选项:
    • default:使用模型的默认精度。
    • auto (comfy):让 ComfyUI 决定合适的精度。
    • FP32:完整的 float32 精度。
    • FP16:半精度,有助于减少显存占用。
    • BF16:bfloat16 精度,适用于受支持的硬件。
  • lora_name (COMBO):选择要应用于 PixArt 模型的单个 LoRA 文件。
  • lora_model_strength (FLOAT,默认 1,范围 -1010,步长 0.01):控制已选择的 LoRA 对模型的影响强度。允许使用负值。
  • ratio (COMBO,默认 "1.00"):按名称选择宽高比预设。默认的 "1.00" 对应正方形 1:1 宽高比。
  • empty_latent_width (INT):已生成的空 Latent 的像素宽度。未设置默认值,因此请指定所需宽度。
  • empty_latent_height (INT):已生成的空 Latent 的像素高度。未设置默认值,因此请指定所需高度。
  • positive (STRING,默认 ""):用于条件的正面文本提示词。
  • negative (STRING,默认 ""):用于条件的负面文本提示词。
  • batch_size (INT,默认 1,范围 164):在空 Latent 批处理中要创建的 Latent 样本数量。

可选输入

  • optional_lora_stack (LORA_STACK):要应用的附加 LoRA 堆栈。当您需要对模型应用多个 LoRA,或使用来自其他 Easy-Use 节点的 LoRA 堆栈时,此选项非常有用。

输出

  • PIPE_LINE:包含已加载模型、VAE、条件、Latent 以及其他下游 Easy-Use 采样器节点所需设置的 Easy-Use pipeline 对象。
  • MODEL:已加载并应用了 LoRA 修改的 PixArt 扩散模型。
  • VAE:已加载的 VAE,可直接连接到解码器或采样器节点。

使用说明

  • 此节点不提供单独的 CONDITIONING 输出。条件会在内部根据 positivenegative 构建,并包含在 PIPE_LINE 中。
  • 如果使用 model_name 而非 ckpt_name 加载模型,请确保您选择的 VAE、CLIP 和 T5 与模型的依赖项匹配。
  • PixArt 使用 SD3 风格的 T5 文本编码器,因此 t5_type 目前固定为 sd3
  • padding 值会在 T5 文本编码期间应用。如果您处理的是较长的提示词,可能需要增大此值,以避免提示词标记被截断或错位。
  • device 默认为 cpu;如果您的硬件支持更快的 T5/CLIP 编码,请切换到 gpuauto
  • ratio 是一个便捷的宽高比预设。实际的输出 Latent 分辨率由 empty_latent_widthempty_latent_height 控制。
  • 在应用多个 LoRA 时,请使用 optional_lora_stack;LoRA 强度值可以为负,以反转或减弱效果。

评论

使用 GitHub 登录后即可参与讨论。

评论加载中…