MultimodalDeepSeek open-source Janus-Pro-7B, un modèle d'IA multimodal pour la compréhension et la génération d'images. Apprenez à l'utiliser dans ComfyUI.
Open-Weights
Nouveautés de l'écosystème ComfyUI : sorties de modèles open source, nœuds personnalisés, workflows et outils de génération d'images, de vidéos et d'audio.
MultimodalDeepSeek open-source Janus-Pro-7B, un modèle d'IA multimodal pour la compréhension et la génération d'images. Apprenez à l'utiliser dans ComfyUI.
Open-Weights
Image vers 3DTencent lance Hunyuan3D 2.0, en open source le modèle DiT complet et présente un moteur de création 3D tout-en-un avec des fonctionnalités innovantes incluant l'animation squelettique et la conversion de croquis en 3D, révolutionnant la création de contenu pour le métavers et les jeux
Open-Weights
ComfyUI célèbre son deuxième anniversaire, évoluant d'un projet personnel en l'outil visuel d'IA générative le plus populaire au monde. Joyeux anniversaire, ComfyUI !
MIT
NVIDIA lance le nouveau modèle Sana capable de générer rapidement des images jusqu'à une résolution 4K sur des GPU d'ordinateurs portables grand public, avec support d'intégration ComfyUI
Open-Weights
ByteDance lance l'outil de synchronisation labiale open source LatentSync, basé sur un modèle de diffusion d'espace latent conditionné par l'audio, permettant une synchronisation labiale précise pour les personnes réelles et les personnages animés tout en résolvant les problèmes de scintillement d'images
Open-Weights
Texte vers imageByteDance et l'Université des Sciences et Technologies de Chine lancent conjointement l'adaptateur VMix, qui améliore la qualité esthétique des images générées par l'IA grâce à la technologie de contrôle du mélange d'attention croisée, s'intégrant parfaitement aux modèles existants sans nécessiter de réentraînement
Open-Weights
Image vers 3DLe modèle StereoCrafter, développé conjointement par Tencent AI Lab et ARC Lab, est désormais open source. Il peut convertir n'importe quelle vidéo 2D en vidéo 3D stéréoscopique de haute qualité, compatible avec divers appareils d'affichage 3D, y compris l'Apple Vision Pro
Open-Weights
Édition d'imagelllyasviel, créateur de ControlNet et IC-Light, lance LuminaBrush, un outil offrant un contrôle précis des effets d'éclairage grâce à un cadre en deux étapes et une expérience de pinceau intuitive
Open-Weights
Le projet Genesis lance un nouveau moteur physique universel et une plateforme d'IA générative, intégrant la simulation physique, le contrôle robotique et les capacités d'IA générative pour fournir des solutions complètes pour les applications robotiques et d'IA physique
Open-Weights
Odyssey présente Explorer, le premier modèle génératif de mondes capable de convertir des images 2D en mondes 3D complets, avec prise en charge d'effets dynamiques et d'édition avec des outils créatifs conventionnels, apportant des changements révolutionnaires pour le cinéma, les jeux et d'autres domaines
Open-Weights
Texte vers imageLe populaire plugin Impact-Pack de ComfyUI contient un malware de minage via le package Ultralytics, affectant de nombreux utilisateurs. Cet article détaille la situation du virus et les solutions.
Open-Weights
Texte vers imageLuma présente les modèles révolutionnaires de génération d'images Photon et Photon Flash, redéfinissant la création par IA avec une valeur exceptionnelle et une qualité d'image supérieure
Open-Weights
Tencent lance officiellement HunyuanVideo, le plus grand modèle de génération vidéo de l'industrie avec 13 milliards de paramètres, atteignant des performances de pointe en termes de qualité vidéo et de stabilité des mouvements
Open-Weights
Texte vers imageStability AI présente trois nouveaux modèles ControlNet pour Stable Diffusion 3.5 Large, comprenant Blur, Canny et Depth, offrant un contrôle plus précis sur la génération d'images
Open-Weights
NVIDIA a lancé la nouvelle technologie Edify 3D, capable de générer des actifs 3D de haute qualité en seulement deux minutes, incluant une géométrie détaillée, une topologie claire, des textures haute résolution et des matériaux PBR.
Open-Weights
Texte vers vidéoLightricks lance le modèle de génération vidéo en temps réel LTX-Video basé sur DiT, permettant la génération en temps réel de vidéos de haute qualité, et a été open-sourcé sur GitHub et Hugging Face.
Open-Weights
Texte vers imageL'équipe InstantX a publié le modèle IP-Adapter basé sur FLUX.1-dev, apportant des capacités de référence d'image plus puissantes au modèle FLUX
Open-Weights
Texte vers imageBlack Forest Labs publie une variété d'outils officiels FLUX, y compris le redessin local, ControlNet, et la conversion de style d'image
Open-Weights
Édition d'imageIC-Light V2 est un modèle d'édition d'images basé sur Flux qui prend en charge divers traitements d'images stylisées, y compris les peintures à l'huile et les styles d'anime. Cet article détaille les nouvelles fonctionnalités et applications d'IC-Light V2.
Open-Weights
Texte vers imageStability AI lance Stable Diffusion 3.5, offrant plusieurs variantes de modèles puissants, soutenant l'utilisation commerciale et dominant le marché en termes de qualité d'image et d'adhérence aux prompts.
Open-Weights