SenseNova-U1.5: lanzamiento completo con edición 4K y texto mejorados

ComfyUI Wikinews

SenseTime lanza SenseNova-U1.5-8B-MoT completo: expertos destilados con OPD, mejor 4K, edición preservada y texto mejorado, ejecutable en ComfyUI.

SenseTime ha lanzado la versión completa de SenseNova-U1.5-8B-MoT, la versión de producción del modelo multimodal unificado que fue presentado en vista previa en julio. Conserva la misma Arquitectura NEO-unify, pero el entrenamiento ahora construye expertos especializados por tarea (texto e infografía, estética, edición) y los destila de nuevo en un único modelo mediante OPD (destilación on-policy). En inferencia es un modelo único sin router.

Ejemplos de generación y edición de SenseNova-U1.5

Seis mejoras visibles para el usuario

El lanzamiento oficial se centra en seis áreas:

  • Generación de imágenes de mayor calidad con mejor composición, armonía de color, renderizado de materiales, iluminación y detalle local.
  • Mejor renderizado de texto e infografías, con texto chino e inglés más legible en pósters, infografías y recursos de marca.
  • Generación nativa 4K más eficiente con estructura global coherente y salida de alta resolución estable.
  • Edición de imágenes nativa más confiable, preservando la identidad del sujeto y el contenido sin editar en ediciones locales, por texto, con múltiples referencias, inserción y reemplazo.
  • Seguimiento más robusto de instrucciones complejas para conteos de objetos, relaciones espaciales, diseños y múltiples restricciones en una sola solicitud.
  • Control visual más preciso a través de cajas delimitadoras, marcadores visuales y referencias de una o múltiples imágenes.

Pruebas de rendimiento

PruebaU1U1.5 Vista PreviaU1.5 Completo
Qwen-Image-Bench47.1455.20 (PE)60.18 (PE)
ImgEdit3.94.374.59
GEdit-Bench-EN7.478.148.26
Resumen de pruebas de rendimiento de SenseNova-U1.5

Ejecútalo en ComfyUI

El paquete de nodos oficial ComfyUI-SenseNova-U1 (v0.3.0) ejecuta la versión completa localmente: de texto a imagen, edición de una y múltiples imágenes con hasta 10 imágenes de referencia ordenadas, además de adaptadores LoRA acelerados para carga local. Instálalo desde ComfyUI Manager o el Registro de Comfy (comfy node install ComfyUI-SenseNova-U1).

Pesos: Hugging Face | ModelScope | GitHub

Comentarios

Inicia sesión con GitHub para unirte a la conversación.

Cargando comentarios…
SenseNova-U1.5: lanzamiento completo con edición 4K y texto mejorados | ComfyUI Wiki