Новости ComfyUI и релизы открытого ИИ

Новости экосистемы ComfyUI: релизы открытых моделей, пользовательские ноды, рабочие процессы и инструменты для генерации изображений, видео и аудио.

Изображение → 3D
Базовая модель
Tencent выпускает Hunyuan3D 2.0: модель генерации 3D с открытым исходным кодом и сквозной движок создания

Tencent выпускает Hunyuan3D 2.0, открывая исходный код полной модели DiT и запуская универсальный движок 3D-создания с инновационными функциями, включая скелетную анимацию и создание 3D из эскизов, революционизируя создание контента для метавселенной и игр

Open-Weights

Текст → изображение

Двухлетний юбилей проекта ComfyUI

Текст → изображение
Базовая модель
Двухлетний юбилей проекта ComfyUI

ComfyUI празднует свой второй день рождения, эволюционировав от личного проекта до самого популярного в мире инструмента генеративного ИИ для визуализации. С днем рождения, ComfyUI!

MIT

Текст → изображение

NVIDIA открывает исходный код Sana - ИИ-модель для эффективной генерации 4K изображений

Текст → изображение
Базовая модель
NVIDIA открывает исходный код Sana - ИИ-модель для эффективной генерации 4K изображений

NVIDIA выпускает новую модель Sana, способную быстро генерировать изображения до 4K разрешения на GPU потребительских ноутбуков, с поддержкой интеграции ComfyUI

Open-Weights

Анимация персонажей

ByteDance открывает исходный код LatentSync - технология высокоточного синхронизации губ на основе диффузионной модели

Анимация персонажей
Инструмент
ByteDance открывает исходный код LatentSync - технология высокоточного синхронизации губ на основе диффузионной модели

ByteDance выпускает инструмент синхронизации губ с открытым исходным кодом LatentSync, основанный на диффузионной модели латентного пространства с аудио-условиями, обеспечивающий точную синхронизацию губ как для реальных людей, так и для анимированных персонажей, одновременно решая проблемы дрожания кадров, распространенные в традиционных методах

Open-Weights

Текст → изображение
Адаптер
VMix: ByteDance представляет инновационную технологию эстетического улучшения для диффузионных моделей текст-в-изображение

ByteDance и Университет науки и технологий Китая совместно запускают адаптер VMix, улучшающий эстетику ИИ-генерированных изображений через технологию контроля смешивания кросс-внимания, бесшовно интегрируясь с существующими моделями без переобучения

Open-Weights

Изображение → 3D
Инструмент
Tencent открывает исходный код StereoCrafter: однокликовое преобразование 2D в 3D видео

StereoCrafter, совместно разработанный Tencent AI Lab и ARC Lab, теперь открыт для использования. Он может преобразовывать любое 2D видео в высококачественное стереоскопическое 3D видео, поддерживая различные 3D устройства отображения, включая Apple Vision Pro

Open-Weights

Редактирование изображений
ControlNet
LuminaBrush: AI-редактор освещения от создателя ControlNet

lllyasviel, создатель ControlNet и IC-Light, выпускает LuminaBrush — новый AI-инструмент, обеспечивающий точный контроль освещения через двухэтапную архитектуру с интуитивным управлением кистью

Open-Weights

Текст → видео
Базовая модель
Genesis: выпущен прорывной универсальный физический движок и платформа генеративного ИИ

Проект Genesis выпускает новый универсальный физический движок и платформу генеративного ИИ, интегрируя физическое моделирование, управление роботами и возможности генеративного ИИ для предоставления комплексных решений для робототехники и физических приложений ИИ

Open-Weights

Изображение → 3D
Базовая модель
Odyssey выпускает Explorer — генеративную модель для создания 3D-миров

Odyssey представила Explorer — первую генеративную модель, способную преобразовывать 2D-изображения в полноценные 3D-миры с поддержкой динамических эффектов и интеграцией с популярными инструментами для творчества. Решение открывает новые возможности для кино, игр и других сфер.

Open-Weights

Текст → изображение
Базовая модель
В плагине ComfyUI Impact-Pack обнаружен майнинг-вирус - требуется срочное действие

В популярном плагине ComfyUI Impact-Pack обнаружен майнинг-вредонос через пакет Ultralytics, затронувший многочисленных пользователей. В статье подробно описана ситуация с вирусом и решения.

Open-Weights

Текст → изображение
Базовая модель
Luma запускает Photon - революционную модель генерации изображений ИИ с исключительной ценностью

Luma представляет революционные модели генерации изображений Photon и Photon Flash, переопределяя ИИ-творчество с выдающейся ценностью и превосходным качеством изображений

Open-Weights

Текст → видео

Tencent открывает исходный код HunyuanVideo — новая эра генерации видео

Текст → видео
Базовая модель
Tencent открывает исходный код HunyuanVideo — новая эра генерации видео

Tencent официально открыла исходный код HunyuanVideo — самой крупной на данный момент модели генерации видео с 13 миллиардами параметров, которая демонстрирует высокие показатели качества видео и стабильности движения

Open-Weights

Изображение → 3D

NVIDIA выпускает Edify 3D — технология генерации 3D-ассетов

Изображение → 3D
Исследования
NVIDIA выпускает Edify 3D — технология генерации 3D-ассетов

NVIDIA представила новую технологию Edify 3D, которая позволяет создавать качественные 3D-ассеты всего за две минуты, включая детализированную геометрию, чёткую топологию, текстуры высокого разрешения и материалы PBR.

Open-Weights

Текст → видео
Базовая модель
Lightricks выпускает модель генерации видео в реальном времени LTX-Video

Lightricks представляет модель генерации видео LTX-Video на основе DiT, поддерживающую создание высококачественных видео в реальном времени. Модель доступна с открытым исходным кодом на GitHub и Hugging Face.

Open-Weights

Редактирование изображений
Базовая модель
Выпуск IC-Light V2: улучшенные возможности редактирования изображений

IC-Light V2 - это модель редактирования изображений на основе Flux, которая поддерживает различные стилизованные обработки изображений, включая масляные картины и аниме стили. В статье подробно описаны новые функции и применения IC-Light V2.

Open-Weights

Текст → изображение
Базовая модель
Запущен Stable Diffusion 3.5: новая эра в генерации изображений ИИ

Stability AI выпускает Stable Diffusion 3.5, предлагая множественные мощные варианты моделей, поддерживая коммерческое использование и лидируя на рынке в качестве изображений и следовании промптам.

Open-Weights