M87 — это ранняя предварительная версия эстетического LoRA для Krea 2 Turbo, которая улучшает композицию, освещение, атмосферу и визуальную текстуру — делает генерации более кинематографичными и художественно направленными, не привязываясь к конкретному стилю.
Новости ComfyUI и релизы открытого ИИ
Новости экосистемы ComfyUI: релизы открытых моделей, пользовательские ноды, рабочие процессы и инструменты для генерации изображений, видео и аудио.
Alissonerdx выпустил LTX-Best-Face-ID — LoRA сохранения личности для LTX-2, использующую перекрывающееся кондиционирование, маркировку исходной фазы TASS-RoPE и loss ArcFace. Не требует белого фона в ComfyUI.
Редактирование изображенийOstris добавил в AI Toolkit поддержку обучения моделей Krea 2 с референсными изображениями, что позволяет обучать LoRA для редактирования, осваивая такие концепции, как «сделать циклопом», всего за 1750 шагов.
MIT
Tanmay Patil выпустил Krea 2 Depth ControlNet-LoRA, добавив генерацию изображений с управлением по глубине в Krea 2. Работает как с Krea 2 Raw, так и с Turbo, достигая согласованности глубины 0,99 по корреляции Пирсона.
Krea-2-Community
Текст → изображениеFlux2-Klein-9B-True-V2 — это последняя полная тонкая настройка от wikeeyang на основе FLUX.2-klein-9B, обеспечивающая значительные улучшения в фотореализме, точности следования промпту, совместимости с LoRA и качестве редактирования изображений.
FLUX-1-dev-non-commercial
Meituan выпускает LongCat 2.0, языковую модель MoE с 1,6 триллиона параметров и окном контекста в 1 миллион токенов, полностью обученную на оборудовании AI ASIC. Веса модели скоро будут доступны под лицензией MIT.
Alissonerdx выпускает Edit Anything — Apache-2.0 открытый LoRA для редактирования видео на LTX-2.3, с функциями передачи движения, многозадачного редактирования без эталонного изображения и преобразования видео по эталону — всё через ComfyUI BFSnodes.
Comfy MCP: Превратите вашего ИИ-агента в креативного технолога
Comfy Org запускает Comfy MCP, соединяя ИИ-агентов с ComfyUI через протокол Model Context Protocol. Теперь агенты могут искать модели, выполнять рабочие процессы и генерировать изображения, видео и 3D-контент на естественном языке.
Kandinsky Lab (Сбер) выпускает KVAE-Audio — непрерывный аудиоавтоэнкодер с 166,9 млн параметров, обеспечивающий реконструкцию высочайшего качества для речи, музыки и общих звуков на полной полосе 48 кГц.
ilkerzgi выпускает более 1500 стилевых LoRA для Krea 2: массивная библиотека стилей с открытым исходным кодом
ilkerzgi выпустил более 1500 стилевых LoRA для Krea 2 на Hugging Face, охватывающих 7 категорий от иллюстраций до фотографий. Каждая LoRA готова к использованию в ComfyUI.
Редактирование видеоfal.ai выпустила LTX-2.3 3DREAL IC-LoRA — контекстную LoRA для LTX-Video, которая преобразует черновые 3D-заготовки и CG-рендеры в фотореалистичное, кинематографичное видео, сохраняя исходную композицию и движение камеры.
Open-Weights
МультимодальныеNVIDIA открывает исходный код LocateAnything-3B, модели визуально-языковой привязки с Parallel Box Decoding (PBD) для быстрой и точной локализации объектов, поддерживающей обнаружение объектов, привязку элементов GUI, локализацию OCR и точечную привязку в различных областях
Open-Weights
Редактирование видеоWhatDreamsCost выпускает LTX Director 2.0 — масштабное обновление бесплатного инструмента для видеомонтажа ComfyUI с открытым исходным кодом, добавляющее полную поддержку видео, интеграцию IC-LoRA, аудиоинпейнтинг, режим повторной съемки для выборочной регенерации и полное обновление интерфейса.
FuzzPuppy выпускает LTX-2.3 Foley LoRA — LoRA-адаптер «видео-в-аудио», который добавляет реалистичные, синхронизированные с изображением звуковые эффекты к видео, сгенерированным LTX-2.3, без наложения фоновой музыки.
Изображение → видеоЛаборатория C4G HKUST выпускает DomainShuttle — модель генерации видео с открытой предметной областью под лицензией Apache 2.0, построенную на базе Wan2.2-T2V-14B. Она включает Domain-MoT, Video-Reference DualRoPE и Cross-Pair Consistent Loss для гибкого сохранения достоверности в пределах домена и переноса стиля между доменами.
Apache-2.0
Текст → изображениеKrea.ai выпустила Krea 2 Raw и Turbo — открытую весовую модель Diffusion Transformer с 12,9 млрд параметров для генерации текста в изображение. ComfyUI поддерживает её нативно с готовыми рабочими процессами.
Krea-2-Community
Редактирование изображенийBoogu-Image-0.1-Edit: это модель редактирования изображений под лицензией Apache 2.0 из семейства Boogu-Image, предлагающая редактирование по инструкциям с единой мультимодальной архитектурой понимания и генерации.
Apache-2.0
Синтез речиHiggs TTS 3: это модель преобразования текста в речь с 4 млрд параметров, поддерживающая более 100 языков, с клонированием голоса без обучения, выразительным контролем эмоций и встроенными эффектами просодии и звуков для голосовых агентов.
Open-Weights
Текст → видеоSulphur 2 — это созданная сообществом доработка LTX 2.3, предлагающая генерацию видео из текста и изображения со встроенным улучшателем промптов и дистиллированной LoRA, обученная на 125K+ отобранных клипов.
Open-Weights
OpenMOSS выпускает MOVA - модель синхронизированной генерации видео и аудио с открытым исходным кодом
Команда OpenMOSS выпускает MOVA (MOSS Video and Audio) - фундаментальную модель сквозной синхронизированной генерации видео и аудио, которая генерирует видео и аудио за один проход вывода, обеспечивая точную синхронизацию губ и осознанные окружением звуковые эффекты, полностью открывая веса модели, код обучения и вывода
Open-Weights