JoyAI Image: Modelo Unificado Multimodal de Edición de Imágenes de JD Open Source

JoyAI Image es un modelo fundacional multimodal unificado de JD Open Source para edición de imágenes guiada por instrucciones. Combina 8B MLLM + 16B MMDiT con soporte nativo de ComfyUI.

J

JoyAI Image by JD Open Source

Image EditingInstruction-GuidedSpatial EditingMultimodal

JoyAI-Image es un modelo fundacional multimodal unificado desarrollado por JD Open Source que combina un Modelo de Lenguaje Grande Multimodal (MLLM) de 8B con un Transformer de Difusión Multimodal (MMDiT) de 16B. Ofrece comprensión de imágenes, generación de texto a imagen y edición de imágenes guiada por instrucciones con una fuerte inteligencia espacial. Ahora con soporte nativo en ComfyUI.

Variantes

VarianteDescripciónMejor para
JoyAI-Image-EditEdición guiada por instrucciones de imagen únicaEdiciones espaciales precisas, manipulación de objetos, control de cámara
JoyAI-Image-Edit-PlusEdición guiada por instrucciones multi-imagen (1-6 imágenes de referencia)Composición entre imágenes, consistencia multi-referencia

Seleccione una variante para ver tutoriales, nodos personalizados y noticias relacionadas. Las descargas de pesos curados están disponibles en el catálogo del Model Hub.

Comentarios

Inicia sesión con GitHub para unirte a la conversación.

Cargando comentarios…