Texte vers vidéoBlack Forest Labs dévoile FLUX 3, un modèle de base multimodal unifié générant des vidéos de 20 secondes avec son natif, des images et la prédiction d'actions pour la robotique.
API-Only
Nouveautés de l'écosystème ComfyUI : sorties de modèles open source, nœuds personnalisés, workflows et outils de génération d'images, de vidéos et d'audio.
Texte vers vidéoBlack Forest Labs dévoile FLUX 3, un modèle de base multimodal unifié générant des vidéos de 20 secondes avec son natif, des images et la prédiction d'actions pour la robotique.
API-Only
Texte vers imageMicrosoft Asia publie Mage-Flow -- compact stack 4B pour texte-image et edition d'images, resolution native 512-2048, variantes RL et Turbo, licence MIT.
MIT
Image vers imageDamkohler a publié JLC Flux2 ControlNet v1.0.0, un ControlNet pour FLUX.2 dans ComfyUI avec composition multi-branche, conditionnement par référence et in/out-painting.
Oasis Suite v1.5 transforme Image Oasis en un pack de trois nœuds, ajoutant Video Oasis Viewer pour la prévisualisation et LTX2.3 Oasis pour la génération vidéo LTX 2.3 tout-en-un.
Lightricks publie le Clean Plate IC-LoRA pour LTX-2.3 : un LoRA vidéo-à-vidéo qui supprime les personnes et objets des séquences et reconstruit l'arrière-plan vide, sans nécessiter de masque.
tarn59 a publié deux LoRAs de transfert de style pour Bernini-R : style anime et style vie réelle, permettant la conversion de style vidéo à vidéo directement dans ComfyUI.
Apache-2.0
PiD v1.5 de Nvidia Research : meilleure qualité de décodage pour FLUX, FLUX.2 et Qwen-Image, couleurs plus fidèles, moins d'artefacts et détails renforcés.
DreamFast publie un encodeur de texte Qwen3-VL-4B non censuré pour ComfyUI, atteignant 100 % de taux de réussite d'attaque (HarmBench ASR) dans les formats BF16, FP8, INT8, NVFP4 et MXFP8.
Apache-2.0
Lightricks publie un LoRA officiel LTX-2.3 Foley V2A pour des effets sonores réalistes et synchronisés visuellement : pas, impacts, frappe au clavier et audio environnemental.
ComfyUI v0.28.0 ajoute la prise en charge native du SeedVR2 upscaling, le support NVIDIA PID 1.5 PixelDiT, les optimisations convrot int4, de nouveaux nœuds Save 3D et Text Overlay, ainsi que des mises à jour de nœuds partenaires incluant sync.so sync-3 et Seedream 5 Pro.
Fal publie Ideogram V4 Fast (20 étapes FP4, inférence en 5s) et Ideogram V4 Instant (8 étapes BF16, inférence en 2s), des variantes distillées avec support sans CFG. Disponibles au format int8-convrot pour ComfyUI via Hippotes.
Open-Weights
Texte vers vidéoTongyi Lab (Alibaba) publie Wan-Dancer-14B, un modèle open source qui génère des vidéos de danse 720p/30fps à partir de musique et d'images de référence, prenant en charge les genres de danse classique chinoise, K-Pop, street, claquettes et latine pour des sorties durant plus d'une minute.
LiconStudio publie la V2 de son populaire LoRA de référence multi-sujet pour LTX-2.3, avec une meilleure cohérence, stabilité et logique de scène basée sur les retours de la communauté.
Cseti publie un nouvel IC-LoRA pour LTX-Video 2.3 qui agit comme une seconde caméra virtuelle, permettant de re-rendre des scènes vidéo depuis de nouveaux angles de caméra à l'aide de simples invites textuelles.
Apache-2.0
Cseti publie une IC-LoRA de preuve de concept pour LTX-2.3 qui agit comme une deuxième caméra virtuelle, vous permettant de modifier l'angle de caméra d'une vidéo existante à l'aide d'un vocabulaire de prompt discret.
Texte vers vidéoAlaya Lab a publié AlayaWorld, un framework open source full-stack pour construire des mondes génératifs interactifs. Il propose une cohérence vidéo à long terme au-delà d'une minute, un contrôle de caméra en temps réel et une interaction pilotée par prompts.
rzgar publie Bernini-R-S2V, un fine-tuning parole-à-vidéo qui ajoute les capacités de synchronisation labiale pilotée par l'audio de Wan2.2 S2V au modèle Bernini-R de ByteDance, avec des nœuds personnalisés ComfyUI dédiés et plusieurs variantes de précision.
Apache-2.0
Robbyant, filiale d'Ant Group, publie en open-source LingBot-Video, un modèle de génération vidéo MoE 30B-A3B atteignant l'état de l'art sur RBench sous licence Apache 2.0.
Apache-2.0
Un nouveau LoRA d'ostris permet le transfert de référence de style sur Krea 2 Turbo, entraîné sur des milliers de paires de style sélectionnées manuellement avec AI Toolkit.
Lightricks publie le Cinemagraph IC-LoRA pour LTX-2.3, un adaptateur open-weight qui gèle les arrière-plans tout en ne déplaçant qu'un seul élément, produisant des boucles naturelles et impeccables à partir de n'importe quelle image fixe.
LTX-2 Community License