SenseNova-U1.5 : lancement complet, édition 4K et texte renforcés
SenseTime livre SenseNova-U1.5-8B-MoT complet : experts distillés par OPD, meilleure 4K, édition préservée et texte renforcé, exécutable dans ComfyUI.
SenseTime a publié la version complète de SenseNova-U1.5-8B-MoT, la version de production du modèle multimodale unifié qui avait fait l'objet d'un aperçu en juillet. Elle conserve la même architecture NEO-unify, mais l'entraînement se concentre désormais sur des experts spécialisés par tâche (texte et infographies, esthétique, édition) et les distille à nouveau dans un seul modèle via OPD (distillation on-policy). En inférence, c'est un seul modèle sans routeur.
Six améliorations visibles pour l'utilisateur
La version officielle met l'accent sur six domaines :
- Génération d'image de meilleure qualité avec une meilleure composition, harmonie des couleurs, rendu des matériaux, éclairage et détails locaux.
- Meilleur rendu de texte et infographies, avec plus de lisibilité du texte chinois et anglais dans les affiches, infographies et ressources de marque.
- Génération native 4K plus efficace avec une structure globale cohérente et une sortie haute résolution stable.
- Édition d'image native plus fiable, préservant l'identité du sujet et le contenu non modifié à travers les éditions locales, textuelles, multi-références, insertion et remplacement.
- Suivi plus robuste des instructions complexes pour les comptes d'objets, relations spatiales, mises en page et multiples contraintes dans une seule demande.
- Contrôle visuel plus précis grâce aux boîtes englobantes, marqueurs visuels et références à une ou plusieurs images.
Benchmarks
| Benchmark | U1 | U1.5 Aperçu | U1.5 Complet |
|---|---|---|---|
| Qwen-Image-Bench | 47.14 | 55.20 (PE) | 60.18 (PE) |
| ImgEdit | 3.9 | 4.37 | 4.59 |
| GEdit-Bench-EN | 7.47 | 8.14 | 8.26 |
Exécutez-le dans ComfyUI
Le Pack de Nœuds officiel ComfyUI-SenseNova-U1 (v0.3.0) exécute la version complète localement : texte vers image, édition d'image unique et multiple avec jusqu'à 10 images de référence ordonnées, plus des adaptateurs LoRA accélérés pour le chargement local. Installez-le depuis le Gestionnaire ComfyUI ou le Registre Comfy (comfy node install ComfyUI-SenseNova-U1).
Poids : Hugging Face | ModelScope | GitHub
Commentaires
Connectez-vous avec GitHub pour rejoindre la discussion.