JoyAI Image: Унифицированная мультимодальная модель редактирования изображений от JD Open Source

JoyAI Image — это унифицированная мультимодальная фундаментальная модель от JD Open Source для редактирования изображений по текстовым инструкциям. Объединяет 8B MLLM + 16B MMDiT с нативной поддержкой ComfyUI.

J

JoyAI Image by JD Open Source

Image EditingInstruction-GuidedSpatial EditingMultimodal

JoyAI-Image — это унифицированная мультимодальная фундаментальная модель, разработанная JD Open Source, которая объединяет 8B мультимодальную языковую модель (MLLM) с 16B мультимодальным диффузионным трансформером (MMDiT). Она обеспечивает понимание изображений, генерацию изображений по тексту и редактирование изображений по инструкциям с развитым пространственным интеллектом. Теперь поддерживается нативно в ComfyUI.

Варианты

ВариантОписаниеЛучше всего подходит для
JoyAI-Image-EditРедактирование одного изображения по инструкцииТочные пространственные правки, манипуляция объектами, управление камерой
JoyAI-Image-Edit-PlusРедактирование нескольких изображений по инструкции (1-6 референсных изображений)Композиция из нескольких изображений, согласованность нескольких референсов

Выберите вариант для получения инструкций, пользовательских узлов и связанных новостей. Подобранные веса моделей доступны в каталоге Model Hub.

Комментарии

Войдите через GitHub, чтобы участвовать в обсуждении.

Загрузка комментариев…