Actualités ComfyUI et sorties IA open source

Nouveautés de l'écosystème ComfyUI : sorties de modèles open source, nœuds personnalisés, workflows et outils de génération d'images, de vidéos et d'audio.

Image vers vidéo

Publication Open Source d'InfiniteTalk - Technologie de génération vidéo pilotée par l'audio avec prise en charge d'une longueur illimitée

Image vers vidéo
Modèle de base
Publication Open Source d'InfiniteTalk - Technologie de génération vidéo pilotée par l'audio avec prise en charge d'une longueur illimitée

L'équipe MeiGen-AI a publié en open source le modèle InfiniteTalk, permettant une synchronisation labiale précise et une génération de vidéos de longueur illimitée. Il prend en charge la conversion image-vidéo et vidéo-vidéo, marquant une avancée dans la technologie des humains numériques.

MIT

Texte vers image
Outil
L'Équipe Hunyuan de Tencent Publie le Framework MixGRPO en Open Source pour Améliorer l'Efficacité d'Entraînement dans l'Alignement des Préférences Humaines

L'équipe Hunyuan de Tencent lance le framework open source MixGRPO, le premier à intégrer l'échantillonnage mixte ODE-SDE à fenêtre glissante pour GRPO, atteignant jusqu'à 71% d'accélération d'entraînement pour l'alignement des préférences humaines dans les modèles de diffusion et de flux.

Open-Weights

Texte vers image

Black Forest Labs Lance la Version Open Source FLUX.1 Krea [dev] avec Support Natif ComfyUI

Texte vers image
Modèle de base
Black Forest Labs Lance la Version Open Source FLUX.1 Krea [dev] avec Support Natif ComfyUI

La collaboration entre Black Forest Labs et Krea lance officiellement le modèle FLUX.1 Krea [dev], le meilleur modèle FLUX open source pour la génération de texte vers image. ComfyUI a implémenté un support natif, permettant aux utilisateurs d'expérimenter la dernière technologie de génération de texte vers image.

FLUX-1-dev-non-commercial

Texte vers vidéo

Publication de la version open source de WAN2.2 et prise en charge native par ComfyUI dès le premier jour

Texte vers vidéo
Modèle de base
Publication de la version open source de WAN2.2 et prise en charge native par ComfyUI dès le premier jour

L’équipe WAN annonce officiellement la sortie de la version open source de Wan2.2, qui adopte une architecture MoE innovante et améliore la qualité de la génération vidéo. ComfyUI propose un support natif, permettant aux utilisateurs de découvrir directement cette nouvelle technologie de génération vidéo.

Open-Weights

Synthèse vocale
Outil
Le laboratoire Tongyi lance ThinkSound : Un nouveau paradigme pour la génération et l'édition audio multimodale

Le laboratoire Tongyi publie en open source ThinkSound, le premier framework unifié de génération et d'édition audio Any2Audio prenant en charge le raisonnement en chaîne, permettant des entrées multimodales incluant la vidéo, le texte et l'audio, avec une haute fidélité, une forte synchronisation et des capacités d'édition interactive.

Open-Weights