Texte vers imageMicrosoft Asia publie Mage-Flow -- compact stack 4B pour texte-image et edition d'images, resolution native 512-2048, variantes RL et Turbo, licence MIT.
MIT
Nouveautés de l'écosystème ComfyUI : sorties de modèles open source, nœuds personnalisés, workflows et outils de génération d'images, de vidéos et d'audio.
Texte vers imageMicrosoft Asia publie Mage-Flow -- compact stack 4B pour texte-image et edition d'images, resolution native 512-2048, variantes RL et Turbo, licence MIT.
MIT
Anima Control Pose Preview-2 apporte la génération d'images contrôlée par pose à Anima avec des nœuds personnalisés natifs pour ComfyUI, une prise en charge multi-résolution à 512/768/1024 et une précision de pose améliorée
Lightricks publie le Clean Plate IC-LoRA pour LTX-2.3 : un LoRA vidéo-à-vidéo qui supprime les personnes et objets des séquences et reconstruit l'arrière-plan vide, sans nécessiter de masque.
tarn59 a publié deux LoRAs de transfert de style pour Bernini-R : style anime et style vie réelle, permettant la conversion de style vidéo à vidéo directement dans ComfyUI.
Apache-2.0
DreamFast publie un encodeur de texte Qwen3-VL-4B non censuré pour ComfyUI, atteignant 100 % de taux de réussite d'attaque (HarmBench ASR) dans les formats BF16, FP8, INT8, NVFP4 et MXFP8.
Apache-2.0
Lightricks publie un LoRA officiel LTX-2.3 Foley V2A pour des effets sonores réalistes et synchronisés visuellement : pas, impacts, frappe au clavier et audio environnemental.
ComfyUI v0.28.0 ajoute la prise en charge native du SeedVR2 upscaling, le support NVIDIA PID 1.5 PixelDiT, les optimisations convrot int4, de nouveaux nœuds Save 3D et Text Overlay, ainsi que des mises à jour de nœuds partenaires incluant sync.so sync-3 et Seedream 5 Pro.
Fal publie Ideogram V4 Fast (20 étapes FP4, inférence en 5s) et Ideogram V4 Instant (8 étapes BF16, inférence en 2s), des variantes distillées avec support sans CFG. Disponibles au format int8-convrot pour ComfyUI via Hippotes.
Open-Weights
Texte vers vidéoTongyi Lab (Alibaba) publie Wan-Dancer-14B, un modèle open source qui génère des vidéos de danse 720p/30fps à partir de musique et d'images de référence, prenant en charge les genres de danse classique chinoise, K-Pop, street, claquettes et latine pour des sorties durant plus d'une minute.
LiconStudio publie la V2 de son populaire LoRA de référence multi-sujet pour LTX-2.3, avec une meilleure cohérence, stabilité et logique de scène basée sur les retours de la communauté.
Cseti publie un nouvel IC-LoRA pour LTX-Video 2.3 qui agit comme une seconde caméra virtuelle, permettant de re-rendre des scènes vidéo depuis de nouveaux angles de caméra à l'aide de simples invites textuelles.
Apache-2.0
Cseti publie une IC-LoRA de preuve de concept pour LTX-2.3 qui agit comme une deuxième caméra virtuelle, vous permettant de modifier l'angle de caméra d'une vidéo existante à l'aide d'un vocabulaire de prompt discret.
Texte vers vidéoAlaya Lab a publié AlayaWorld, un framework open source full-stack pour construire des mondes génératifs interactifs. Il propose une cohérence vidéo à long terme au-delà d'une minute, un contrôle de caméra en temps réel et une interaction pilotée par prompts.
rzgar publie Bernini-R-S2V, un fine-tuning parole-à-vidéo qui ajoute les capacités de synchronisation labiale pilotée par l'audio de Wan2.2 S2V au modèle Bernini-R de ByteDance, avec des nœuds personnalisés ComfyUI dédiés et plusieurs variantes de précision.
Apache-2.0
Robbyant, filiale d'Ant Group, publie en open-source LingBot-Video, un modèle de génération vidéo MoE 30B-A3B atteignant l'état de l'art sur RBench sous licence Apache 2.0.
Apache-2.0
Un nouveau LoRA d'ostris permet le transfert de référence de style sur Krea 2 Turbo, entraîné sur des milliers de paires de style sélectionnées manuellement avec AI Toolkit.
Lightricks publie le Cinemagraph IC-LoRA pour LTX-2.3, un adaptateur open-weight qui gèle les arrière-plans tout en ne déplaçant qu'un seul élément, produisant des boucles naturelles et impeccables à partir de n'importe quelle image fixe.
LTX-2 Community License
MultimodalSenseTime publie SenseNova-Vision-7B-MoT, un modèle de 7B paramètres qui unifie la détection, la segmentation, l'estimation de profondeur, la prédiction de normales et la géométrie multi-vue dans un cadre unique suivant des instructions : aucun module spécifique à une tâche n'est nécessaire.
CC BY-NC 4.0
Anima, le modèle texte-image de 2 milliards de paramètres spécialisé dans l'anime, développé par CircleStone Labs, reçoit deux nouvelles variantes officielles : une version rapide Turbo et une version Aesthetic optimisée pour la qualité.
circlestone-labs-non-commercial-license
ComfyUI-Angelo prend désormais en charge les workflows à deux modèles, permettant aux utilisateurs de générer avec Krea 2 (ou tout autre modèle) et d'éditer avec FLUX 2 Klein 9B sur un seul canevas unifié, sans reconnexion manuelle du graphe.