Qwen-Image 2.1 提示词增强模型在 ComfyUI 中运行指南

ComfyUI Wikinews

Qwen 的 PE-T2I 与 PE-I2I 提示词重写模型可将简短需求和编辑指令展开,社区节点包通过加载 CLIP 在 ComfyUI 中同时运行两者。

Qwen-Image 2.1 发布的同时,Qwen 还推出了两个专用的提示词重写模型Qwen-Image-2.1-PE-T2I 用于文生图需求,Qwen-Image-2.1-PE-I2I 用于编辑指令。ComfyUI 目前还没有对应节点,因此一个社区节点包 ComfyUI-Qwen-Image-2.1-Prompt-Enhancer 现在可以将两者接入节点图。

两个重写模型,各司其职

PE 模型是基于 Qwen3.5-VL 9B 微调而来,于 2026-09-20 与基础模型一同发布,官方 Qwen-Image 2.1 README 推荐将它们作为准备提示词的默认方式:“为获得最佳效果,我们推荐使用官方提示词重写模型,把简短提示词展开为详尽、高质量的描述。”

  • PE-T2I 可将任意语言的简短需求转换为一段较长的英文提示词,并附上推荐宽高比。其回答在 think 块之后以 JSON 返回:{"rewritten_prompt": ..., "wh_ratio": "16:9"}
  • PE-I2I 接收一条编辑指令以及最多 10 张引用图像,按 <image1><image2> 等依次引用,并返回精确的编辑提示词。其 JSON 回答会额外包含 ratio_follow,用于指定输出应继承哪张输入图像的宽高比。

两者都应在开启思考(thinking)的情况下采样:官方示例使用 temperature 1.0top_p 0.95top_k 20,其中文生图模型使用 max_new_tokens 16256,编辑模型则使用 24000

官方 Qwen-Image 2.1 多引用图像编辑示例

官方 Qwen-Image 2.1 示例:由五张引用图像组合出的一套穿搭,这正是 PE-I2I 重写模型被训练用来转换为明确提示词的那类多图像指令。

在 ComfyUI 中运行它们

ComfyUI 官方的三个 Qwen-Image 2.1 模板分别覆盖文生图、图像编辑和背景移除,但都没有调用重写模型。Comfy-Org 确实将两个 PE 权重重新打包为 int8 convrot 文件,放在 Comfy-Org/Qwen-Image-2.1 中(text_encoders/qwen3.5_9b_qwen_image_2.1_pe_t2i.int8_convrot.safetensors..._pe_i2i...),但仅仅加载它们只是完成了一半工作:还得有东西来构建对话提示词、读回 JSON,并把结果提供给采样器。

该节点包正是为此提供了两个节点,两者都注册在 Qwen Image 类别下:

节点输入输出
QwenImage21_T2IPromptRewriteCLIP、prompt、采样控制positive_promptnegative_promptwh_ratiothinkingparse_ok
QwenImage21_EditPromptRewriteCLIP、prompt、image_1image_10同上,另加 ratio_follow
T2I 提示词重写节点

T2I 重写节点:输入一条简短提示词,输出展开后的提示词、宽高比与推理过程。

PE 文件由普通的 加载 CLIP 节点加载,type = qwen_image,生成过程走 ComfyUI 自带的 clip.tokenize()clip.generate()clip.decode() 路径,与内置 TextGenerate 节点使用相同的机制。无需外部服务器,也不需要单独的 transformers pipeline。

编辑提示词重写节点

编辑节点提供十个图像槽位,返回重写后的指令以及需要继承的宽高比。

有几项设置值得直接照抄 README,因为这两个模型并不共用这些参数:

参数T2I编辑
presence_penalty1.50
max length1625624000
thinking开启开启

较高的惩罚值可避免文生图重写模型重复输出,而编辑重写模型则应在不启用该惩罚的情况下运行。两个模型都使用 think 块进行训练,因此该节点包会在解析 JSON 之前把推理过程与答案分离,并在答案能够干净解析时报告 parse_ok。安装可选的 json_repair 包后,还能挽救略有格式错误的答案,而不是直接失败。

将其接入节点图

提示词增强器接入 Qwen-Image 2.1 节点图

README 中的节点图:在 PE 模型上使用加载 CLIP,输出接入重写节点,其 positive_prompt 继续送入 Text Encode Qwen Image 2.1。

在文生图运行中,重写后的字符串会替代你原本要输入文本编码节点的内容,而 wh_ratio 可以驱动分辨率选择器,无需手动指定宽度和高度。在编辑运行中,引用图像会放入节点的图像槽位,指令中以 <image1><image2> 的方式引用它们,而 ratio_follow 决定输出画布应匹配哪张输入图像。

获取方式

评论

使用 GitHub 登录后即可参与讨论。

评论加载中…
Qwen-Image 2.1 提示词增强模型在 ComfyUI 中运行指南 | ComfyUI Wiki