Texte vers imageInstantCharacter est une méthode innovante sans réglage qui permet la génération cohérente de personnages à partir d'une seule image, supportant diverses tâches en aval
Open-Weights
Nouveautés de l'écosystème ComfyUI : sorties de modèles open source, nœuds personnalisés, workflows et outils de génération d'images, de vidéos et d'audio.
Texte vers imageInstantCharacter est une méthode innovante sans réglage qui permet la génération cohérente de personnages à partir d'une seule image, supportant diverses tâches en aval
Open-Weights
Texte vers vidéoDéveloppée par Lvmin Zhang, la technologie FramePack compresse le contexte des images d'entrée, rendant la charge de travail de génération vidéo invariante à la longueur de la vidéo, permettant de traiter de nombreuses images même sur des GPU d'ordinateurs portables
Open-Weights
Seaweed-7B réalise des performances supérieures aux modèles de 14 milliards de paramètres avec seulement 7 milliards de paramètres, pour un coût de formation équivalent à un tiers des standards de l'industrie
Open-Weights
Texte vers vidéoUn nouveau cadre de restauration vidéo FloED a publié son code et ses poids, permettant une meilleure cohérence vidéo et efficacité computationnelle grâce au guidage par flux optique
Open-Weights
PixelFlow opère de manière innovante dans l'espace brut des pixels, simplifiant le processus de génération d'images sans nécessiter d'auto-encodeurs variationnels préentraînés, permettant des modèles entraînables de bout en bout
Open-Weights
Image vers 3DHoloPart peut décomposer les modèles 3D en parties complètes et sémantiquement significatives, résolvant les défis d'édition dans la création de contenu 3D
Open-Weights
Image vers 3DUniRig utilise des modèles autorégressifs pour générer des structures squelettiques et des poids de skinning de haute qualité pour divers modèles 3D, simplifiant considérablement le flux de travail d'animation
Open-Weights
MultimodalOmniSVG est un nouveau modèle multimodal unifié de génération SVG capable de produire des graphiques vectoriels hautement complexes et modifiables à partir de diverses entrées, notamment du texte, des images ou des références de personnages
Open-Weights
Texte vers vidéoDes chercheurs développent le modèle TTT-Video utilisant la technologie Test-Time Training basée sur CogVideoX 5B, capable de générer des vidéos cohérentes jusqu'à 63 secondes
MIT
Texte vers imageL'équipe d'Intelligence Créative de ByteDance lance le modèle UNO, offrant une plus grande contrôlabilité grâce à la génération contextuelle, permettant une génération d'images de haute qualité d'un à plusieurs sujets
Open-Weights
Texte vers imageL'équipe Tiamat AI lance le cadre EasyControl, ajoutant des capacités de contrôle conditionnel aux modèles DiT, désormais pris en charge dans ComfyUI via le plugin ComfyUI-easycontrol
Open-Weights
Texte vers imageHiDream.ai publie HiDream-I1, un nouveau modèle texte-image open source avec 17 milliards de paramètres qui surpasse les modèles open source existants dans plusieurs tests comparatifs, permettant la génération d'images de haute qualité dans divers styles
Open-Weights
Image vers 3DL'équipe Stable-X présente Hi3DGen, un cadre innovant pour générer des modèles 3D haute-fidélité à partir d'images, résolvant le manque de détails géométriques des méthodes existantes grâce à la technologie de pontage normal
Open-Weights
Image vers 3DTripoSF, basé sur la représentation innovante SparseFlex, prend en charge la génération de modèles 3D avec des résolutions allant jusqu'à 1024³, capable de gérer des surfaces ouvertes et des structures internes complexes, améliorant significativement la qualité des actifs 3D
Open-Weights
Texte vers vidéoKunlun Wanwei lance SkyReels-A2, le premier cadre de génération vidéo contrôlable de qualité commerciale au monde, permettant la génération vidéo multi-éléments grâce à une architecture à double branche, ouvrant de nouvelles possibilités pour l'e-commerce, la production cinématographique et plus encore
Open-Weights
MultimodalLe laboratoire Tongyi du groupe Alibaba présente VACE, le premier cadre unifié au monde pour diverses tâches vidéo, couvrant la génération de texte en vidéo, l'édition vidéo et les combinaisons de tâches complexes
Open-Weights
MultimodalLe projet StarVector met en œuvre la génération automatique de code graphique vectoriel SVG à partir d'images et de textes, offrant de nouveaux outils créatifs pour les designers et les développeurs.
Open-Weights
Texte vers imageByteDance présente InfiniteYou (InfU), un cadre innovant basé sur les Transformateurs de Diffusion qui permet une recréation flexible de photos tout en préservant l'identité de l'utilisateur, répondant aux limitations des méthodes existantes concernant la similarité d'identité, l'alignement texte-image et la qualité de génération
MIT
Stability AI présente un nouveau modèle d'IA, Stable Virtual Camera, capable de convertir des photos ordinaires en vidéos 3D avec des effets de profondeur et de perspective authentiques, offrant aux créateurs un contrôle intuitif de la caméra
Open-Weights
Image vers 3DL'Université Tsinghua et le laboratoire d'IA de Tencent présentent StdGEN, un pipeline innovant qui génère des personnages 3D de haute qualité et sémantiquement décomposés à partir d'images uniques, permettant la séparation du corps, des vêtements et des cheveux
Open-Weights