Comfy Cloud — Лёгкий доступ к ComfyUI в облаке
Comfy Cloud предоставляет простой доступ к ComfyUI с мощными GPU, популярными моделями и пользовательскими нодами. Присоединяйтесь к закрытому бета-тесту и бесплатно пользуйтесь ComfyUI в облаке.
Новости экосистемы ComfyUI: релизы открытых моделей, пользовательские ноды, рабочие процессы и инструменты для генерации изображений, видео и аудио.
Comfy Cloud предоставляет простой доступ к ComfyUI с мощными GPU, популярными моделями и пользовательскими нодами. Присоединяйтесь к закрытому бета-тесту и бесплатно пользуйтесь ComfyUI в облаке.
Изображение → 3DКоманда Tencent Hunyuan выпускает технологию Voyager, способную генерировать последовательности 3D облаков точек с согласованием мира из одного изображения и заданных пользователем путей камеры, поддерживающую бесконечное исследование мира и прямую 3D реконструкцию
Open-Weights
Текст → изображениеByteDance представляет модель USO, которая может свободно комбинировать любые субъекты и стили, сохраняя согласованность субъектов и достигая высококачественных эффектов переноса стиля
Open-Weights
Wan2.2-S2V - это модель генерации видео с ИИ, которая может преобразовывать статические изображения и аудио в видео, поддерживая потребности в создании контента, такие как диалог, пение и выступление.
Open-Weights
ЭкосистемаПрисоединяйтесь к первому еженедельному челленджу ComfyUI и выиграйте $100! Создайте видео, переворачивающее персонажа кошачьего человека, используя предоставленную карту глубины.
Команда MeiGen-AI открыла модель InfiniteTalk с открытым исходным кодом, обеспечивающую точную синхронизацию губ и генерацию видео неограниченной длины. Поддерживает преобразование изображения в видео и видео в видео, что является прорывом в технологии цифровых людей.
MIT
ComfyUI официально выпускает функцию Subgraph, позволяя пользователям упаковывать сложные комбинации узлов в переиспользуемые отдельные узлы подграфа, значительно улучшая модульность и управление рабочим процессом.
Qwen-Image — модель MMDiT с 20 млрд параметров, ориентированная на сложный рендеринг текста и точное редактирование; теперь доступна нативно в ComfyUI. В заметке — ключевые возможности, лицензия и полезные ресурсы.
Open-Weights
Текст → изображениеКоманда Tencent Hunyuan выпустила фреймворк MixGRPO с открытым исходным кодом, первый, который интегрирует скользящее окно смешанного ODE-SDE сэмплинга для GRPO, достигая до 71% ускорения обучения для выравнивания человеческих предпочтений в диффузионных и поточных моделях.
Open-Weights
Сотрудничество Black Forest Labs и Krea официально выпускает модель FLUX.1 Krea [dev], лучшую открытую модель FLUX для генерации изображений из текста. ComfyUI реализовал нативную поддержку, позволяя пользователям испытать новейшую технологию генерации изображений из текста.
FLUX-1-dev-non-commercial
Команда WAN официально выпустила открытую версию Wan2.2 с инновационной архитектурой MoE, которая значительно улучшает качество генерации видео. ComfyUI реализовала нативную поддержку, позволяя пользователям напрямую опробовать новейшие технологии генерации видео.
Open-Weights
Текст → изображениеByteDance открыла исходный код модели Seed-X 7B, специально разработанной для задач перевода. Модель поддерживает перевод между 28 языками и подходит для интеграции в различные сценарии, такие как генерация изображений с помощью ИИ.
Open-Weights
Текст → видеоPUSA V1.0 использует инновационную технологию VTA для создания качественного видео с поддержкой множества задач при минимальных затратах данных и ресурсов, включая преобразование изображения в видео, генерацию ключевых кадров, расширение видео, генерацию видео по тексту и другие функции.
Open-Weights
Текст → изображениеКоманда AMAP выпускает FLUX-Text, новый метод редактирования текста в сценах на основе диффузии, поддерживающий многоязычность, согласованность стилей и высококачественное редактирование текста.
Open-Weights
Модель OmniAvatar теперь с открытым исходным кодом, поддерживает генерацию видео виртуальных людей в полный рост, управляемую аудио, с естественными движениями и богатыми выражениями, подходит для подкастов, взаимодействий, динамических сцен и различных применений.
Open-Weights
Синтез речиTongyi Lab открывает исходный код ThinkSound, первой унифицированной системы генерации и редактирования аудио Any2Audio, поддерживающей цепочку рассуждений, позволяющей многомодальные входы, включая видео, текст и аудио, с высоким качеством, сильной синхронизацией и возможностями интерактивного редактирования.
Open-Weights
Текст → изображениеByteDance открывает исходный код модели XVerse, позволяющей точный независимый контроль нескольких идентичностей объектов и семантических атрибутов (как поза, стиль, освещение), улучшая персонализацию и возможности сложных сцен в генерации ИИ-изображений.
Open-Weights
Black Forest Labs выпускает версию Flux.1 Kontext Dev с открытым исходным кодом, модель диффузионного трансформера с 12 миллиардами параметров, с немедленной нативной поддержкой в ComfyUI
Open-Weights
МультимодальныеVectorSpaceLab выпускает OmniGen2, мощную многомодальную модель генерации, которая поддерживает точное локальное редактирование изображений через инструкции на естественном языке, включая удаление и замену объектов, перенос стиля, обработку фона и многое другое
Open-Weights
Исследовательская команда NVIDIA представляет UniRelight, универсальную технологию переосвещения на основе диффузии, которая достигает высококачественных эффектов переосвещения через одно изображение или видео
Open-Weights