M87 est un LoRA esthétique en aperçu précoce pour Krea 2 Turbo qui améliore la composition, l'éclairage, l'atmosphère et la texture visuelle : rendant les générations plus cinématographiques et dirigées artistiquement sans se limiter à un style spécifique.
Actualités ComfyUI et sorties IA open source
Nouveautés de l'écosystème ComfyUI : sorties de modèles open source, nœuds personnalisés, workflows et outils de génération d'images, de vidéos et d'audio.
Alissonerdx publie LTX-Best-Face-ID, un LoRA de référence vers vidéo pour LTX-2 qui préserve l'identité via un conditionnement par chevauchement, un marquage de phase source TASS-RoPE et une perte d'identité ArcFace. Aucun fond blanc nécessaire dans ComfyUI.
Édition d'imageOstris a intégré dans AI Toolkit la prise en charge de l’entraînement des modèles Krea 2 avec des images de référence, permettant l’entraînement de LoRA de style édition qui maîtrise des concepts comme « fais de cette personne un cyclope » en seulement 1 750 étapes.
MIT
Tanmay Patil a publié le Krea 2 Depth ControlNet-LoRA, ajoutant la génération d'images conditionnée par profondeur à Krea 2. Fonctionne avec Krea 2 Raw et Turbo, avec une cohérence de profondeur atteignant 0,99 de corrélation de Pearson.
Krea-2-Community
Texte vers imageFlux2-Klein-9B-True-V2 est le dernier affinage complet réalisé par wikeeyang à partir de FLUX.2-klein-9B, apportant des améliorations significatives en photoréalisme, respect des prompts, compatibilité LoRA et qualité d'édition d'images.
FLUX-1-dev-non-commercial
Meituan publie LongCat 2.0, un modèle de langage MoE de 1,6 billion de paramètres avec une fenêtre de contexte d'un million de tokens, entièrement entraîné sur du matériel ASIC IA. Les poids du modèle seront bientôt disponibles sous licence MIT.
Alissonerdx publie Edit Anything, un LoRA open-source sous licence Apache 2.0 pour le montage vidéo avec LTX-2.3, proposant le transfert de mouvement, le montage multitâche sans référence et la vidéo-à-vidéo par référence : le tout via les nœuds ComfyUI BFSnodes.
Comfy MCP : Transformez votre agent IA en technologue créatif
Comfy Org lance Comfy MCP, connectant les agents IA à ComfyUI via le Model Context Protocol. Les agents peuvent désormais rechercher des modèles, exécuter des workflows et générer des images, vidéos et contenus 3D en langage naturel.
Kandinsky Lab (Sber) publie KVAE-Audio, un autoencodeur audio continu de 166,9 millions de paramètres offrant une qualité de reconstruction de pointe pour la parole, la musique et les sons généraux à 48 kHz pleine bande.
ilkerzgi publie plus de 1 500 LoRAs de style Krea 2 : une immense bibliothèque open-source de styles
ilkerzgi a publié plus de 1 500 LoRAs de style Krea 2 sur Hugging Face, couvrant 7 catégories de l'illustration à la photographie. Chaque LoRA est prêt à l'emploi dans ComfyUI.
Édition vidéofal.ai a publié LTX-2.3 3DREAL IC-LoRA, un LoRA contextuel pour LTX-Video qui transforme les maquettes 3D brutes et les rendus CG en vidéos photoréalistes et cinématographiques tout en préservant la composition et le mouvement de la caméra d'origine.
Open-Weights
MultimodalNVIDIA rend open-source LocateAnything-3B, un modèle de grounding vision-langage doté du Parallel Box Decoding (PBD) pour une localisation rapide et précise d'objets, prenant en charge la détection d'objets, le grounding d'éléments GUI, la localisation OCR et le grounding par points dans divers domaines.
Open-Weights
Édition vidéoWhatDreamsCost publie LTX Director 2.0, une mise à jour majeure de l’outil gratuit et open source de montage vidéo pour ComfyUI, ajoutant la prise en charge complète des vidéos, l’intégration d’IC‑LoRA, l’inpainting audio, le mode Retake pour la régénération sélective et une refonte totale de l’interface.
FuzzPuppy publie LTX-2.3 Foley LoRA, un adaptateur LoRA vidéo-à-audio qui ajoute des effets sonores réalistes et synchronisés visuellement aux vidéos générées par LTX-2.3 sans superposition de musique de fond.
Image vers vidéoLe C4G de HKUST publie DomainShuttle, un modèle de génération vidéo orienté sujet en domaine ouvert sous licence Apache-2.0, construit sur Wan2.2-T2V-14B. Il intègre Domain-MoT, DualRoPe pour la référence vidéo et une perte de cohérence cross-pair pour une fidélité intra-domaine flexible et un transfert de style inter-domaines.
Apache-2.0
Texte vers imageKrea.ai a publié Krea 2 Raw et Turbo, un Diffusion Transformer open-weight de 12,9 milliards de paramètres pour la génération texte-image. ComfyUI le supporte nativement avec des workflows prêts à l'emploi.
Krea-2-Community
Édition d'imageBoogu-Image-0.1-Edit est un modèle d’édition d’image sous licence Apache 2.0 de la famille Boogu-Image, offrant une édition d’image basée sur des instructions avec une architecture unifiée de compréhension et de génération multimodale.
Apache-2.0
Synthèse vocaleHiggs TTS 3 est un modèle de synthèse vocale de 4 milliards de paramètres prenant en charge plus de 100 langues avec clonage vocal zero-shot, contrôle émotionnel expressif et effets sonores/prosodie en ligne pour les applications d'agents vocaux.
Open-Weights
Texte vers vidéoSulphur 2 est un fine-tuning communautaire de LTX 2.3 offrant une génération vidéo texte-vers-vidéo et image-vers-vidéo, avec un améliorateur de prompt intégré et un distill LoRA, entraîné sur plus de 125 000 clips sélectionnés.
Open-Weights
OpenMOSS publie MOVA - modèle de génération synchronisée vidéo et audio open source
L'équipe OpenMOSS publie MOVA (MOSS Video and Audio), un modèle fondamental de génération synchronisée vidéo et audio de bout en bout qui génère vidéo et audio en une seule inférence, réalisant une synchronisation labiale précise et des effets sonores conscients de l'environnement, avec poids du modèle, entraînement et code d'inférence entièrement open source
Open-Weights