Qwen-Image: Модель генерации изображений по тексту для ComfyUI. Загрузка и руководство.

ComfyUI Wiki

Qwen-Image: базовая модель генерации изображений от Alibaba с мощными возможностями рендеринга текста и редактирования. Доступна в нескольких форматах квантизации для ComfyUI.

Q

Qwen-Image

Текст в изображениеРендеринг текстаРедактирование изображенийКвантизированные

Базовая модель генерации изображений по тексту из серии Qwen от Alibaba. Основана на архитектуре Diffusion Transformer, превосходно справляется с рендерингом сложного текста (особенно китайского), точным редактированием изображений и общей генерацией изображений с поддержкой разнообразных художественных стилей. Доступна в вариантах BF16, FP8, FP8 mixed, NVFP4 и разрешении 2.5K.

РазработчикAlibaba Cloud (Qwen Team)
Дата выпуска2025-08-04
АрхитектураDiffusion Transformer (DiT)
ЛицензияApache 2.0
Текстовый энкодерQwen2.5-VL-7B
ПайплайнDiffusers (text-to-image)
ControlNetsInstantX Union/Inpainting, DiffSynth Canny/Depth/Inpaint

Guides and workflows related to this model series.

No articles found.

Комментарии

Войдите через GitHub, чтобы участвовать в обсуждении.

Загрузка комментариев…