Actualités ComfyUI et sorties IA open source

Nouveautés de l'écosystème ComfyUI : sorties de modèles open source, nœuds personnalisés, workflows et outils de génération d'images, de vidéos et d'audio.

Image vers vidéo
Fine-tune
DomainShuttle : HKUST publie en open source un modèle 14B de texte vers vidéo orienté sujet basé sur Wan2.2

Le C4G de HKUST publie DomainShuttle, un modèle de génération vidéo orienté sujet en domaine ouvert sous licence Apache-2.0, construit sur Wan2.2-T2V-14B. Il intègre Domain-MoT, DualRoPe pour la référence vidéo et une perte de cohérence cross-pair pour une fidélité intra-domaine flexible et un transfert de style inter-domaines.

Apache-2.0

Multimodal

OpenMOSS publie MOVA - modèle de génération synchronisée vidéo et audio open source

Multimodal
Modèle de base
OpenMOSS publie MOVA - modèle de génération synchronisée vidéo et audio open source

L'équipe OpenMOSS publie MOVA (MOSS Video and Audio), un modèle fondamental de génération synchronisée vidéo et audio de bout en bout qui génère vidéo et audio en une seule inférence, réalisant une synchronisation labiale précise et des effets sonores conscients de l'environnement, avec poids du modèle, entraînement et code d'inférence entièrement open source

Open-Weights