Comfy Cloud - Accès facile à ComfyUI dans le cloud
Comfy Cloud offre un accès simple à ComfyUI avec des GPU puissants, des modèles populaires et des nœuds personnalisés. Rejoignez la bêta privée pour utiliser ComfyUI gratuitement dans le cloud.
Nouveautés de l'écosystème ComfyUI : sorties de modèles open source, nœuds personnalisés, workflows et outils de génération d'images, de vidéos et d'audio.
Comfy Cloud offre un accès simple à ComfyUI avec des GPU puissants, des modèles populaires et des nœuds personnalisés. Rejoignez la bêta privée pour utiliser ComfyUI gratuitement dans le cloud.
Image vers 3DL'équipe Tencent Hunyuan publie la technologie Voyager, capable de générer des vidéos de séquences de nuages de points 3D cohérentes avec le monde à partir d'une seule image et de trajectoires de caméra définies par l'utilisateur, prenant en charge l'exploration infinie du monde et la reconstruction 3D directe
Open-Weights
Texte vers imageByteDance lance le modèle USO, capable de combiner librement n'importe quel sujet avec n'importe quel style tout en maintenant la cohérence du sujet et en obtenant des effets de transfert de style de haute qualité
Open-Weights
Wan2.2-S2V est un modèle de génération vidéo IA qui peut convertir des images statiques et de l'audio en vidéos, soutenant les besoins de création de contenu comme le dialogue, le chant et la performance.
Open-Weights
ÉcosystèmeParticipez au premier Défi Hebdomadaire ComfyUI et gagnez 100 $ ! Créez une vidéo qui retourne le personnage de l'homme-chat en utilisant la carte de profondeur fournie.
L'équipe MeiGen-AI a publié en open source le modèle InfiniteTalk, permettant une synchronisation labiale précise et une génération de vidéos de longueur illimitée. Il prend en charge la conversion image-vidéo et vidéo-vidéo, marquant une avancée dans la technologie des humains numériques.
MIT
ComfyUI lance officiellement la fonction Subgraph, permettant aux utilisateurs d'empaqueter des combinaisons complexes de nœuds en nœuds de sous-graphe réutilisables individuels, améliorant considérablement la modularité et la gestion du flux de travail.
Qwen-Image est un modèle MMDiT de 20B axé sur le rendu de texte complexe et l'édition précise ; il est désormais utilisable nativement dans ComfyUI. Cet article résume ses capacités clés, sa licence et les ressources.
Open-Weights
Texte vers imageL'équipe Hunyuan de Tencent lance le framework open source MixGRPO, le premier à intégrer l'échantillonnage mixte ODE-SDE à fenêtre glissante pour GRPO, atteignant jusqu'à 71% d'accélération d'entraînement pour l'alignement des préférences humaines dans les modèles de diffusion et de flux.
Open-Weights
La collaboration entre Black Forest Labs et Krea lance officiellement le modèle FLUX.1 Krea [dev], le meilleur modèle FLUX open source pour la génération de texte vers image. ComfyUI a implémenté un support natif, permettant aux utilisateurs d'expérimenter la dernière technologie de génération de texte vers image.
FLUX-1-dev-non-commercial
L’équipe WAN annonce officiellement la sortie de la version open source de Wan2.2, qui adopte une architecture MoE innovante et améliore la qualité de la génération vidéo. ComfyUI propose un support natif, permettant aux utilisateurs de découvrir directement cette nouvelle technologie de génération vidéo.
Open-Weights
Texte vers imageByteDance a publié en open source le modèle Seed-X 7B, conçu spécifiquement pour les tâches de traduction. Il prend en charge la traduction entre 28 langues et peut être intégré dans divers scénarios comme la génération d’images par IA.
Open-Weights
Texte vers vidéoPUSA V1.0 exploite la technologie innovante VTA pour réaliser une génération vidéo multi-tâches de haute qualité avec un minimum de données et de coûts, prenant en charge l'image vers vidéo, la génération d'images clés, l'extension vidéo, le texte vers vidéo et plus encore.
Open-Weights
Texte vers imageL'équipe AMAP publie FLUX-Text, une nouvelle méthode d'édition de texte en scène basée sur la diffusion, prenant en charge le multilingue, la cohérence de style et l'édition de texte haute fidélité.
Open-Weights
Le modèle OmniAvatar est maintenant open source, permettant la génération de vidéos d'humains virtuels en corps entier contrôlés par audio avec des mouvements naturels et des expressions riches, adapté aux podcasts, aux interactions, aux scènes dynamiques et à diverses applications.
Open-Weights
Synthèse vocaleLe laboratoire Tongyi publie en open source ThinkSound, le premier framework unifié de génération et d'édition audio Any2Audio prenant en charge le raisonnement en chaîne, permettant des entrées multimodales incluant la vidéo, le texte et l'audio, avec une haute fidélité, une forte synchronisation et des capacités d'édition interactive.
Open-Weights
Texte vers imageByteDance open-source le modèle XVerse, permettant un contrôle précis et indépendant de plusieurs identités de sujets et d'attributs sémantiques (comme la pose, le style, l'éclairage), améliorant les capacités de personnalisation et de scènes complexes de la génération d'images par IA.
Open-Weights
Black Forest Labs publie la version open source de Flux.1 Kontext Dev, un modèle de transformateur de diffusion de 12B paramètres, avec support natif immédiat dans ComfyUI
Open-Weights
MultimodalVectorSpaceLab lance OmniGen2, un puissant modèle de génération multimodale qui prend en charge l'édition précise d'images locales via des instructions en langage naturel, incluant la suppression et le remplacement d'objets, le transfert de style, le traitement d'arrière-plan et plus
Open-Weights
L'équipe de recherche de NVIDIA présente UniRelight, une technologie universelle de réillumination basée sur la diffusion qui permet des effets de réillumination de haute qualité à partir d'une seule image ou vidéo
Open-Weights