Модели ComfyUI и загрузки

Находите и скачивайте модели, поддерживаемые стандартными и пользовательскими узлами ComfyUI, или определяйте модели, необходимые вашим workflow.

Обзор семейств моделей. Откройте карточку для версий, загрузок и документов.

Текст в изображение

Ovi: модель генерации аудио и видео с двумя магистралями от Character.AI

Ovi от Character.AI : это модель генерации аудио и видео с двумя магистралями, построенная на Wan2.2. Генерирует синхронизированное аудио и видео в обоих направлениях с кондиционированием MMAUDIO.

Страниц версий: 03
Текст в изображение

SkyReels-V2: Бесконечная генерация видео от Skywork

SkyReels-V2 : первая открытая модель генерации видео бесконечной длины с использованием Diffusion Forcing. Основана на Wan2.1, поддерживает T2V, I2V и авторегрессионную генерацию видео.

Страниц версий: 01
Текст в изображение

Anima: модель текст-в-изображение для аниме с 2 миллиардами параметров от Circlestone Labs

Anima: модель текст-в-изображение с 2 миллиардами параметров от Circlestone Labs и Comfy Org. Ориентирована на аниме-концепции и художественные стили. Доступна в вариантах Base, Aesthetic и Turbo для ComfyUI.

Страниц версий: 06
Текст в изображение

Семейство Qwen: открытые модели текстового энкодера

Модели текстового энкодера Qwen от Alibaba для использования в ComfyUI: Qwen3-VL (зрительно-языковая модель) и Qwen3.5 (только текст).

Страниц версий: 24
Текст в изображение

Семейство Z-Image: модели S3-DiT с 6B параметров от Tongyi-MAI (Alibaba)

Z-Image: эффективное семейство моделей генерации изображений от Tongyi-MAI (Alibaba). Отличается архитектурой DiT с одним потоком и 6B параметров, с вариантами для качества (Z-Image) и скорости (Z-Image-Turbo).

Страниц версий: 24
Видео

Семейство VOID: удаление объектов и взаимодействий из видео от Netflix — Apache-2.0

VOID от Netflix — это модель удаления объектов и взаимодействий из видео, которая убирает объекты вместе со всеми вызванными физическими взаимодействиями.

Страниц версий: 11
Аудио

Stable Audio: Открытые модели текст-в-аудио

Stable Audio: открытое семейство моделей текст-в-аудио от Stability AI для генерации музыки, звуковых эффектов и фоли, включающее Stable Audio Open 1.0 и Stable Audio 3.

Страниц версий: 21
Редактирование изображения

Семейство Qwen-Image: открытая генерация изображений от Alibaba для ComfyUI

Qwen-Image — это открытая фундаментальная модель генерации изображений от Alibaba из серии Qwen, превосходно справляющаяся со сложным рендерингом текста и точным редактированием изображений.

Страниц версий: 35
Текст в изображение

Семейство PixelDiT: VAE-free пиксельный DiT + PiD суперразрешение от NVIDIA

PixelDiT by NVIDIA is a VAE-free pixel-space diffusion transformer for text-to-image generation. Includes PiD (Pixel Diffusion Decoder) models for super-resolution up to 4K.

Страниц версий: 13
Текст в изображение

Семейство Ovis: модели генерации изображений на основе зрения и языка для ComfyUI

Ovis - это серия моделей генерации изображений на основе зрения и языка от AIDC-AI для использования с ComfyUI, включающая диффузионные модели и текстовые кодировщики.

Страниц версий: 11
Мультимодальная

OmniGen: Унифицированная мультимодальная модель генерации для ComfyUI

OmniGen — это серия унифицированных мультимодальных моделей генерации от VectorSpace Lab, поддерживающая генерацию текста в изображение, редактирование изображений и генерацию в контексте.

Страниц версий: 10
Текст в изображение

NewBie-image: генерация изображений в аниме-стиле для ComfyUI

NewBie-image Exp0.1 — это модель Next-DiT с 3,5 млрд параметров от NewBie AI Lab, специализирующаяся на создании изображений в аниме-стиле.

Страниц версий: 11
Текст в изображение

Семейство Lumina: потоковая генерация изображений для ComfyUI

Lumina-Image 2.0 от Alpha-VLLM: это 2-миллиардный параметрный потоковый диффузионный трансформер для генерации изображений из текста.

Страниц версий: 13
Редактирование изображения

Семейство LongCat: двуязычная генерация изображений для ComfyUI

LongCat от Meituan — это новаторская открытая двуязычная (китайско-английская) фундаментальная модель для генерации изображений с превосходным рендерингом китайского текста и фотореализмом.

Страниц версий: 23
Текст в изображение

Семейство Krea: открытый Diffusion Transformer с вариантами Raw и Turbo

Krea 2 - это модель генерации изображений с открытым исходным кодом от Krea. Включает варианты Raw (полное качество) и Turbo (дистиллированный) со стилевыми LoRA для разнообразных художественных эффектов.

Страниц версий: 12
Текст в изображение

Семейство Ideogram: Diffusion Transformer с превосходной типографикой от Ideogram AI

Ideogram 4: передовая модель AI для генерации изображений по тексту от Ideogram AI. Отличается продвинутой типографикой и фотореалистичными возможностями генерации.

Страниц версий: 13
Текст в изображение

Gemma Family: открытые модели текстовых энкодеров Google для ComfyUI

Gemma это семейство открытых моделей Google DeepMind, используемых в качестве текстовых энкодеров для ComfyUI, включая Gemma 4 с инструктивно-настроенными вариантами E2B и E4B.

Страниц версий: 12
Текст в изображение

ERNIE-Image: генерация изображений с открытым исходным кодом 8B от Baidu — Apache-2.0

ERNIE-Image: серия открытых моделей преобразования текста в изображение от Baidu с 8 миллиардами параметров и легким улучшителем подсказок, отличающаяся высоким качеством рендеринга текста и структурированной генерации.

Страниц версий: 10
Текст в изображение

Chroma: открытые текстово-изобразительные и апскейлинговые модели для ComfyUI

Chroma — серия моделей от lodestones, включающая Chroma1-HD (8.9B T2I) и Chroma1-Radiance (апскейлинг в разработке), обе лицензированы Apache 2.0.

Страниц версий: 20
Редактирование изображения

Boogu-Image: Генерация изображений с открытым исходным кодом для ComfyUI

Boogu-Image — универсальная серия моделей генерации изображений с базовыми, турбо и редактируемыми вариантами для ComfyUI.

Страниц версий: 21
ВидеоТекст в изображение

Wan Video Family: открытая генерация видео с ИИ

Серия моделей генерации видео с открытым исходным кодом от Alibaba Cloud. От Wan2.1 до Wan2.2, обеспечивающая высококачественную генерацию текста в видео и изображения в видео с архитектурой MoE.

Страниц версий: 235
ВидеоТекст в изображение

Семейство моделей Stable Diffusion: SD 1.5, SDXL, SD 3.5 для ComfyUI

Линейка Stable Diffusion от Stability AI: SD 1.5 (Runway), SD 2.x, SDXL и SD 3.5. Открытые чекпоинты для генерации текста в изображение, широко используемые в ComfyUI.

Страниц версий: 713
Видео

LTX Video: Модель генерации видео в реальном времени

LTX-Video — это первая модель генерации видео на основе DiT от Lightricks с 2 миллиардами параметров, поддерживающая генерацию видео из текста и изображений.

Страниц версий: 30
Мультимодальная

DeepSeek Janus: Мультимодальная модель ИИ для ComfyUI

DeepSeek Janus Pro — это мультимодальная модель ИИ, способная как понимать, так и генерировать изображения, с открытым исходным кодом, выпущенная компанией DeepSeek в январе 2025 года.

Страниц версий: 10
Текст в изображение

IC-Light: модель релайтинга изображений на основе ИИ для ComfyUI

IC-Light: серия моделей релайтинга изображений от lllyasviel. Версия вводит кондиционирование переднего плана для профессионального релайтинга изображений.

Страниц версий: 00
3D-модель

Hunyuan3D: Генерация 3D-моделей с открытым исходным кодом

Hunyuan3D представляет собой серию открытых моделей 3D-генерации от Tencent. Версия 2.0 поддерживает создание высококачественных 3D-моделей с текстурами высокого разрешения на основе текста, изображения или наброска.

Страниц версий: 21
Видео

Семейство Hunyuan Video: открытая генерация видео от Tencent

Открытая серия моделей генерации видео от Tencent. От v1.0 до v1.5: высококачественная генерация текста в видео и изображения в видео.

Страниц версий: 21
Текст в изображение

HiDream-I1: модель генерации изображений по тексту с открытым исходным кодом на 17B параметров

HiDream-I1 — это модель генерации изображений по тексту с 17B параметров от HiDream-ai, сочетающая DiT с архитектурой MoE. Лицензия MIT. Доступна в вариантах Full/Dev/Fast.

Страниц версий: 22
Текст в изображение

Семейство Flux: открытые модели генерации изображений для ComfyUI

Flux: открытая серия моделей генерации изображений от Black Forest Labs. Два поколения: FLUX.1 (3.8B DiT) и FLUX.2 (32B dense transformer).

Страниц версий: 54
Текст в изображение

ACE-Step: Руководство по модели генерации музыки ComfyUI

ACE-Step — это открытая базовая модель генерации музыки, совместно разработанная StepFun и ACE Studio, поддерживающая генерацию музыки, редактирование и синтез аудио.

Страниц версий: 21