Новости ComfyUI и релизы открытого ИИ

Новости экосистемы ComfyUI: релизы открытых моделей, пользовательские ноды, рабочие процессы и инструменты для генерации изображений, видео и аудио.

Текст → изображение
Базовая модель
Tencent Hunyuan и команда InstantX выпускают проект с открытым исходным кодом InstantCharacter

InstantCharacter - это инновационный метод без настройки, который обеспечивает генерацию с сохранением персонажа из одного изображения, поддерживая различные нисходящие задачи

Open-Weights

Текст → видео
Базовая модель
FramePack: Эффективная модель предсказания следующего кадра для генерации видео

Разработанная Lvmin Zhang, технология FramePack сжимает контекст входного кадра, делая рабочую нагрузку генерации видео инвариантной к длине видео, позволяя обрабатывать многочисленные кадры даже на GPU ноутбуков

Open-Weights

Текст → видео

ByteDance выпускает Seaweed-7B: Экономически эффективная базовая модель генерации видео

Текст → видео
Базовая модель
ByteDance выпускает Seaweed-7B: Экономически эффективная базовая модель генерации видео

Seaweed-7B достигает производительности, превосходящей модели с 14B параметрами, имея только 7 миллиардов параметров, при стоимости обучения всего в одну треть от отраслевых стандартов, принося новые возможности в область генерации видео

Open-Weights

Текст → видео
Инструмент
FloED: Эффективный инпейнтинг видео с открытым исходным кодом с оптическим потоком-направленной диффузией

Новый фреймворк инпейнтинга видео FloED выпустил свой код и веса, достигая более высокой согласованности видео и вычислительной эффективности через направление оптического потока

Open-Weights

Текст → изображение
Исследования
PixelFlow: Генеративные модели, работающие напрямую в пиксельном пространстве

PixelFlow инновационно работает в сыром пиксельном пространстве, упрощая процесс генерации изображений без необходимости предобученных вариационных автоэнкодеров, обеспечивая сквозно обучаемые модели

Open-Weights

Изображение → 3D
Инструмент
VAST-AI и Университет Цинхуа открывают исходный код UniRig: Фреймворк для автоматического скелетного риггинга всех 3D моделей

UniRig использует авторегрессионные модели для генерации высококачественных скелетных структур и весов скиннинга для разнообразных 3D моделей, значительно упрощая рабочий процесс анимации

Open-Weights

Мультимодальные
Базовая модель
OmniSVG: Университет Фудань и StepFun запускают унифицированную модель генерации векторной графики

OmniSVG - это новая унифицированная мультимодальная модель генерации SVG, способная производить высокосложную, редактируемую векторную графику из различных входных данных, включая текст, изображения или ссылки на персонажей

Open-Weights

Текст → изображение
Инструмент
ByteDance выпускает UNO: Расширение возможностей генерации от меньшего к большему

Команда ByteDance Creative Intelligence выпускает модель UNO, разблокируя большую управляемость через генерацию в контексте, достигая генерации высококачественных изображений от одного до множественных объектов

Open-Weights

Текст → изображение
Инструмент
EasyControl: Новый фреймворк для эффективного и гибкого управления Diffusion Transformer

Команда Tiamat AI выпускает фреймворк EasyControl, добавляющий возможности условного управления к моделям DiT, теперь поддерживается в ComfyUI через плагин ComfyUI-easycontrol

Open-Weights

Текст → изображение
Базовая модель
HiDream-I1 - Выпуск с открытым исходным кодом - Модель генерации изображений следующего поколения

HiDream.ai выпускает HiDream-I1, новую модель генерации изображений из текста с открытым исходным кодом с 17B параметрами, которая превосходит существующие модели с открытым исходным кодом в множественных бенчмарках, поддерживая генерацию высококачественных изображений в различных стилях

Open-Weights

Изображение → 3D
Инструмент
Hi3DGen: новая платформа для генерации высококачественной 3D геометрии через нормальное мостирование

Команда Stable-X представляет Hi3DGen, инновационную платформу для генерации высококачественных 3D моделей из изображений, решая проблему отсутствия геометрических деталей в существующих методах через технологию нормального мостирования

Open-Weights

Изображение → 3D
Исследования
VAST AI Research открывает исходный код TripoSF: переопределение новых высот в технологии 3D генерации

TripoSF, основанный на инновационном представлении SparseFlex, поддерживает генерацию 3D моделей с разрешением до 1024³, способен обрабатывать открытые поверхности и сложные внутренние структуры, значительно улучшая качество 3D активов

Open-Weights

Текст → видео
Инструмент
Kunlun Wanwei открывает исходный код SkyReels-A2: коммерческая платформа генерации видео

Kunlun Wanwei выпускает первую в мире коммерческую контролируемую платформу генерации видео SkyReels-A2, обеспечивающую генерацию многоэлементного видео через двухветвевую архитектуру, принося новые возможности для электронной коммерции, кинопроизводства и многого другого

Open-Weights

Мультимодальные
Инструмент
Лаборатория Tongyi Alibaba выпускает VACE: создание и редактирование видео вступает в эпоху унификации

Лаборатория Tongyi группы Alibaba представляет VACE, первую в мире унифицированную платформу для разнообразных задач с видео, охватывающую генерацию видео из текста, редактирование видео и сложные комбинации задач

Open-Weights

Текст → изображение
Инструмент
ByteDance выпускает InfiniteYou: гибкое пересоздание фотографий с сохранением личности пользователя

ByteDance представляет InfiniteYou (InfU), инновационную платформу на основе Diffusion Transformers, которая обеспечивает гибкое пересоздание фотографий с сохранением личности пользователя, решая ограничения существующих методов в отношении сходства личности, выравнивания текст-изображение и качества генерации

MIT

Изображение → 3D

Stability AI выпускает Stable Virtual Camera: технология для преобразования 2D фотографий в 3D видео

Изображение → 3D
Базовая модель
Stability AI выпускает Stable Virtual Camera: технология для преобразования 2D фотографий в 3D видео

Stability AI запускает новую ИИ-модель Stable Virtual Camera, способную конвертировать обычные фотографии в 3D видео с аутентичными эффектами глубины и перспективы, предоставляя создателям интуитивный контроль камеры

Open-Weights

Изображение → 3D
Исследования
StdGEN: семантически разложенная генерация 3D персонажей из одиночных изображений

Университет Цинхуа и Tencent AI Lab совместно представляют StdGEN, инновационный пайплайн, который генерирует высококачественных семантически разложенных 3D персонажей из одиночных изображений, обеспечивая разделение тела, одежды и волос

Open-Weights