Новости ComfyUI и релизы открытого ИИ

Новости экосистемы ComfyUI: релизы открытых моделей, пользовательские ноды, рабочие процессы и инструменты для генерации изображений, видео и аудио.

Экосистема

Comfy Cloud — Лёгкий доступ к ComfyUI в облаке

Экосистема
Инструмент
Comfy Cloud — Лёгкий доступ к ComfyUI в облаке

Comfy Cloud предоставляет простой доступ к ComfyUI с мощными GPU, популярными моделями и пользовательскими нодами. Присоединяйтесь к закрытому бета-тесту и бесплатно пользуйтесь ComfyUI в облаке.

Изображение → 3D
LoRA
Tencent HunyuanWorld Voyager: Создание 3D видео исследований мира из одного изображения

Команда Tencent Hunyuan выпускает технологию Voyager, способную генерировать последовательности 3D облаков точек с согласованием мира из одного изображения и заданных пользователем путей камеры, поддерживающую бесконечное исследование мира и прямую 3D реконструкцию

Open-Weights

Текст → изображение
Исследования
ByteDance выпустила USO: унифицированную модель генерации изображений с управлением стилем и субъектом

ByteDance представляет модель USO, которая может свободно комбинировать любые субъекты и стили, сохраняя согласованность субъектов и достигая высококачественных эффектов переноса стиля

Open-Weights

Изображение → видео

Wan2.2-S2V: Выпущена модель генерации видео на основе аудио

Изображение → видео
Базовая модель
Wan2.2-S2V: Выпущена модель генерации видео на основе аудио

Wan2.2-S2V - это модель генерации видео с ИИ, которая может преобразовывать статические изображения и аудио в видео, поддерживая потребности в создании контента, такие как диалог, пение и выступление.

Open-Weights

Изображение → видео

Открытый выпуск InfiniteTalk - Технология генерации видео на основе аудио с поддержкой неограниченной длины

Изображение → видео
Базовая модель
Открытый выпуск InfiniteTalk - Технология генерации видео на основе аудио с поддержкой неограниченной длины

Команда MeiGen-AI открыла модель InfiniteTalk с открытым исходным кодом, обеспечивающую точную синхронизацию губ и генерацию видео неограниченной длины. Поддерживает преобразование изображения в видео и видео в видео, что является прорывом в технологии цифровых людей.

MIT

Экосистема

ComfyUI Официально Выпускает Функцию Subgraph

Экосистема
Инструмент
ComfyUI Официально Выпускает Функцию Subgraph

ComfyUI официально выпускает функцию Subgraph, позволяя пользователям упаковывать сложные комбинации узлов в переиспользуемые отдельные узлы подграфа, значительно улучшая модульность и управление рабочим процессом.

Текст → изображение
Базовая модель
Qwen-Image получил нативную поддержку в ComfyUI

Qwen-Image — модель MMDiT с 20 млрд параметров, ориентированная на сложный рендеринг текста и точное редактирование; теперь доступна нативно в ComfyUI. В заметке — ключевые возможности, лицензия и полезные ресурсы.

Open-Weights

Текст → изображение
Инструмент
Команда Tencent Hunyuan открыла исходный код фреймворка MixGRPO для повышения эффективности обучения с выравниванием человеческих предпочтений

Команда Tencent Hunyuan выпустила фреймворк MixGRPO с открытым исходным кодом, первый, который интегрирует скользящее окно смешанного ODE-SDE сэмплинга для GRPO, достигая до 71% ускорения обучения для выравнивания человеческих предпочтений в диффузионных и поточных моделях.

Open-Weights

Текст → изображение

Black Forest Labs выпускает открытую версию FLUX.1 Krea [dev] с нативной поддержкой ComfyUI

Текст → изображение
Базовая модель
Black Forest Labs выпускает открытую версию FLUX.1 Krea [dev] с нативной поддержкой ComfyUI

Сотрудничество Black Forest Labs и Krea официально выпускает модель FLUX.1 Krea [dev], лучшую открытую модель FLUX для генерации изображений из текста. ComfyUI реализовал нативную поддержку, позволяя пользователям испытать новейшую технологию генерации изображений из текста.

FLUX-1-dev-non-commercial

Текст → видео

Выпуск открытой версии WAN2.2 и нативная поддержка ComfyUI с первого дня

Текст → видео
Базовая модель
Выпуск открытой версии WAN2.2 и нативная поддержка ComfyUI с первого дня

Команда WAN официально выпустила открытую версию Wan2.2 с инновационной архитектурой MoE, которая значительно улучшает качество генерации видео. ComfyUI реализовала нативную поддержку, позволяя пользователям напрямую опробовать новейшие технологии генерации видео.

Open-Weights

Текст → изображение
Базовая модель
ByteDance открывает исходный код Seed-X 7B: компактная модель перевода с поддержкой 28 языков

ByteDance открыла исходный код модели Seed-X 7B, специально разработанной для задач перевода. Модель поддерживает перевод между 28 языками и подходит для интеграции в различные сценарии, такие как генерация изображений с помощью ИИ.

Open-Weights

Текст → видео
Базовая модель
PUSA V1.0: Доступная и высокоэффективная модель генерации видео

PUSA V1.0 использует инновационную технологию VTA для создания качественного видео с поддержкой множества задач при минимальных затратах данных и ресурсов, включая преобразование изображения в видео, генерацию ключевых кадров, расширение видео, генерацию видео по тексту и другие функции.

Open-Weights

Текст → изображение
Базовая модель
AMAP выпускает FLUX-Text: новый подход к редактированию текста в сценах

Команда AMAP выпускает FLUX-Text, новый метод редактирования текста в сценах на основе диффузии, поддерживающий многоязычность, согласованность стилей и высококачественное редактирование текста.

Open-Weights

Анимация персонажей
Базовая модель
OmniAvatar: выпуск эффективной модели генерации видео виртуальных людей, управляемой аудио

Модель OmniAvatar теперь с открытым исходным кодом, поддерживает генерацию видео виртуальных людей в полный рост, управляемую аудио, с естественными движениями и богатыми выражениями, подходит для подкастов, взаимодействий, динамических сцен и различных применений.

Open-Weights

Синтез речи
Инструмент
Tongyi Lab выпускает ThinkSound: новая парадигма для многомодальной генерации и редактирования аудио

Tongyi Lab открывает исходный код ThinkSound, первой унифицированной системы генерации и редактирования аудио Any2Audio, поддерживающей цепочку рассуждений, позволяющей многомодальные входы, включая видео, текст и аудио, с высоким качеством, сильной синхронизацией и возможностями интерактивного редактирования.

Open-Weights

Текст → изображение
Базовая модель
Выпущен XVerse: модель генерации изображений с высокой согласованностью и контролем идентичности нескольких объектов и семантических атрибутов

ByteDance открывает исходный код модели XVerse, позволяющей точный независимый контроль нескольких идентичностей объектов и семантических атрибутов (как поза, стиль, освещение), улучшая персонализацию и возможности сложных сцен в генерации ИИ-изображений.

Open-Weights

Текст → изображение

Выпущена версия Flux.1 Kontext Dev с открытым исходным кодом с нативной поддержкой ComfyUI

Текст → изображение
Базовая модель
Выпущена версия Flux.1 Kontext Dev с открытым исходным кодом с нативной поддержкой ComfyUI

Black Forest Labs выпускает версию Flux.1 Kontext Dev с открытым исходным кодом, модель диффузионного трансформера с 12 миллиардами параметров, с немедленной нативной поддержкой в ComfyUI

Open-Weights

Мультимодальные
Базовая модель
Выпущен OmniGen2: унифицированная модель понимания и генерации изображений с инструкциями на естественном языке

VectorSpaceLab выпускает OmniGen2, мощную многомодальную модель генерации, которая поддерживает точное локальное редактирование изображений через инструкции на естественном языке, включая удаление и замену объектов, перенос стиля, обработку фона и многое другое

Open-Weights

Редактирование видео

NVIDIA выпускает UniRelight - универсальная технология переосвещения на основе диффузии

Редактирование видео
Исследования
NVIDIA выпускает UniRelight - универсальная технология переосвещения на основе диффузии

Исследовательская команда NVIDIA представляет UniRelight, универсальную технологию переосвещения на основе диффузии, которая достигает высококачественных эффектов переосвещения через одно изображение или видео

Open-Weights