Модели ComfyUI и загрузки
Находите и скачивайте модели, поддерживаемые стандартными и пользовательскими узлами ComfyUI, или определяйте модели, необходимые вашим workflow.
Обзор семейств моделей. Откройте карточку для версий, загрузок и документов.
Ovi: модель генерации аудио и видео с двумя магистралями от Character.AI
Ovi от Character.AI : это модель генерации аудио и видео с двумя магистралями, построенная на Wan2.2. Генерирует синхронизированное аудио и видео в обоих направлениях с кондиционированием MMAUDIO.
SkyReels-V2: Бесконечная генерация видео от Skywork
SkyReels-V2 : первая открытая модель генерации видео бесконечной длины с использованием Diffusion Forcing. Основана на Wan2.1, поддерживает T2V, I2V и авторегрессионную генерацию видео.

Anima: модель текст-в-изображение для аниме с 2 миллиардами параметров от Circlestone Labs
Anima: модель текст-в-изображение с 2 миллиардами параметров от Circlestone Labs и Comfy Org. Ориентирована на аниме-концепции и художественные стили. Доступна в вариантах Base, Aesthetic и Turbo для ComfyUI.
Семейство Qwen: открытые модели текстового энкодера
Модели текстового энкодера Qwen от Alibaba для использования в ComfyUI: Qwen3-VL (зрительно-языковая модель) и Qwen3.5 (только текст).
Семейство Z-Image: модели S3-DiT с 6B параметров от Tongyi-MAI (Alibaba)
Z-Image: эффективное семейство моделей генерации изображений от Tongyi-MAI (Alibaba). Отличается архитектурой DiT с одним потоком и 6B параметров, с вариантами для качества (Z-Image) и скорости (Z-Image-Turbo).
Семейство VOID: удаление объектов и взаимодействий из видео от Netflix — Apache-2.0
VOID от Netflix — это модель удаления объектов и взаимодействий из видео, которая убирает объекты вместе со всеми вызванными физическими взаимодействиями.
Stable Audio: Открытые модели текст-в-аудио
Stable Audio: открытое семейство моделей текст-в-аудио от Stability AI для генерации музыки, звуковых эффектов и фоли, включающее Stable Audio Open 1.0 и Stable Audio 3.
Семейство Qwen-Image: открытая генерация изображений от Alibaba для ComfyUI
Qwen-Image — это открытая фундаментальная модель генерации изображений от Alibaba из серии Qwen, превосходно справляющаяся со сложным рендерингом текста и точным редактированием изображений.
Семейство PixelDiT: VAE-free пиксельный DiT + PiD суперразрешение от NVIDIA
PixelDiT by NVIDIA is a VAE-free pixel-space diffusion transformer for text-to-image generation. Includes PiD (Pixel Diffusion Decoder) models for super-resolution up to 4K.
Семейство Ovis: модели генерации изображений на основе зрения и языка для ComfyUI
Ovis - это серия моделей генерации изображений на основе зрения и языка от AIDC-AI для использования с ComfyUI, включающая диффузионные модели и текстовые кодировщики.
OmniGen: Унифицированная мультимодальная модель генерации для ComfyUI
OmniGen — это серия унифицированных мультимодальных моделей генерации от VectorSpace Lab, поддерживающая генерацию текста в изображение, редактирование изображений и генерацию в контексте.
NewBie-image: генерация изображений в аниме-стиле для ComfyUI
NewBie-image Exp0.1 — это модель Next-DiT с 3,5 млрд параметров от NewBie AI Lab, специализирующаяся на создании изображений в аниме-стиле.
Семейство Lumina: потоковая генерация изображений для ComfyUI
Lumina-Image 2.0 от Alpha-VLLM: это 2-миллиардный параметрный потоковый диффузионный трансформер для генерации изображений из текста.
Семейство LongCat: двуязычная генерация изображений для ComfyUI
LongCat от Meituan — это новаторская открытая двуязычная (китайско-английская) фундаментальная модель для генерации изображений с превосходным рендерингом китайского текста и фотореализмом.
Семейство Krea: открытый Diffusion Transformer с вариантами Raw и Turbo
Krea 2 - это модель генерации изображений с открытым исходным кодом от Krea. Включает варианты Raw (полное качество) и Turbo (дистиллированный) со стилевыми LoRA для разнообразных художественных эффектов.
Семейство Ideogram: Diffusion Transformer с превосходной типографикой от Ideogram AI
Ideogram 4: передовая модель AI для генерации изображений по тексту от Ideogram AI. Отличается продвинутой типографикой и фотореалистичными возможностями генерации.
Gemma Family: открытые модели текстовых энкодеров Google для ComfyUI
Gemma это семейство открытых моделей Google DeepMind, используемых в качестве текстовых энкодеров для ComfyUI, включая Gemma 4 с инструктивно-настроенными вариантами E2B и E4B.
ERNIE-Image: генерация изображений с открытым исходным кодом 8B от Baidu — Apache-2.0
ERNIE-Image: серия открытых моделей преобразования текста в изображение от Baidu с 8 миллиардами параметров и легким улучшителем подсказок, отличающаяся высоким качеством рендеринга текста и структурированной генерации.
Chroma: открытые текстово-изобразительные и апскейлинговые модели для ComfyUI
Chroma — серия моделей от lodestones, включающая Chroma1-HD (8.9B T2I) и Chroma1-Radiance (апскейлинг в разработке), обе лицензированы Apache 2.0.
Boogu-Image: Генерация изображений с открытым исходным кодом для ComfyUI
Boogu-Image — универсальная серия моделей генерации изображений с базовыми, турбо и редактируемыми вариантами для ComfyUI.
Wan Video Family: открытая генерация видео с ИИ
Серия моделей генерации видео с открытым исходным кодом от Alibaba Cloud. От Wan2.1 до Wan2.2, обеспечивающая высококачественную генерацию текста в видео и изображения в видео с архитектурой MoE.
Семейство моделей Stable Diffusion: SD 1.5, SDXL, SD 3.5 для ComfyUI
Линейка Stable Diffusion от Stability AI: SD 1.5 (Runway), SD 2.x, SDXL и SD 3.5. Открытые чекпоинты для генерации текста в изображение, широко используемые в ComfyUI.
LTX Video: Модель генерации видео в реальном времени
LTX-Video — это первая модель генерации видео на основе DiT от Lightricks с 2 миллиардами параметров, поддерживающая генерацию видео из текста и изображений.
DeepSeek Janus: Мультимодальная модель ИИ для ComfyUI
DeepSeek Janus Pro — это мультимодальная модель ИИ, способная как понимать, так и генерировать изображения, с открытым исходным кодом, выпущенная компанией DeepSeek в январе 2025 года.
IC-Light: модель релайтинга изображений на основе ИИ для ComfyUI
IC-Light: серия моделей релайтинга изображений от lllyasviel. Версия вводит кондиционирование переднего плана для профессионального релайтинга изображений.
Hunyuan3D: Генерация 3D-моделей с открытым исходным кодом
Hunyuan3D представляет собой серию открытых моделей 3D-генерации от Tencent. Версия 2.0 поддерживает создание высококачественных 3D-моделей с текстурами высокого разрешения на основе текста, изображения или наброска.
Семейство Hunyuan Video: открытая генерация видео от Tencent
Открытая серия моделей генерации видео от Tencent. От v1.0 до v1.5: высококачественная генерация текста в видео и изображения в видео.
HiDream-I1: модель генерации изображений по тексту с открытым исходным кодом на 17B параметров
HiDream-I1 — это модель генерации изображений по тексту с 17B параметров от HiDream-ai, сочетающая DiT с архитектурой MoE. Лицензия MIT. Доступна в вариантах Full/Dev/Fast.
Семейство Flux: открытые модели генерации изображений для ComfyUI
Flux: открытая серия моделей генерации изображений от Black Forest Labs. Два поколения: FLUX.1 (3.8B DiT) и FLUX.2 (32B dense transformer).
ACE-Step: Руководство по модели генерации музыки ComfyUI
ACE-Step — это открытая базовая модель генерации музыки, совместно разработанная StepFun и ACE Studio, поддерживающая генерацию музыки, редактирование и синтез аудио.