JoyAI Image: Унифицированная мультимодальная модель редактирования изображений от JD Open Source
JoyAI Image — это унифицированная мультимодальная фундаментальная модель от JD Open Source для редактирования изображений по текстовым инструкциям. Объединяет 8B MLLM + 16B MMDiT с нативной поддержкой ComfyUI.
JoyAI Image by JD Open Source
Image EditingInstruction-GuidedSpatial EditingMultimodalJoyAI-Image — это унифицированная мультимодальная фундаментальная модель, разработанная JD Open Source, которая объединяет 8B мультимодальную языковую модель (MLLM) с 16B мультимодальным диффузионным трансформером (MMDiT). Она обеспечивает понимание изображений, генерацию изображений по тексту и редактирование изображений по инструкциям с развитым пространственным интеллектом. Теперь поддерживается нативно в ComfyUI.
Варианты
| Вариант | Описание | Лучше всего подходит для |
|---|---|---|
| JoyAI-Image-Edit | Редактирование одного изображения по инструкции | Точные пространственные правки, манипуляция объектами, управление камерой |
| JoyAI-Image-Edit-Plus | Редактирование нескольких изображений по инструкции (1-6 референсных изображений) | Композиция из нескольких изображений, согласованность нескольких референсов |
Выберите вариант для получения инструкций, пользовательских узлов и связанных новостей. Подобранные веса моделей доступны в каталоге Model Hub.
Комментарии
Войдите через GitHub, чтобы участвовать в обсуждении.