Édition vidéoJD Open Source publie JoyAI-Video-Edit, un modèle de diffusion autoregressif de 16B qui édite des flux vidéo en direct en temps réel à 30 FPS en 720p.
Apache-2.0
Nouveautés de l'écosystème ComfyUI : sorties de modèles open source, nœuds personnalisés, workflows et outils de génération d'images, de vidéos et d'audio.
Édition vidéoJD Open Source publie JoyAI-Video-Edit, un modèle de diffusion autoregressif de 16B qui édite des flux vidéo en direct en temps réel à 30 FPS en 720p.
Apache-2.0
Texte vers imageUne LoRA ControlNet OpenPose classique pour Krea 2 Turbo : fournissez une carte squelette DWPose et le modèle suit la pose pendant que le prompt définit l'apparence.
Apache-2.0
Texte vers vidéoTéléchargez taeh3.safetensors (TAE MiniMax H3) pour un aperçu vidéo rapide dans ComfyUI. Un petit autoencodeur 2D utilisé via ModelPreviewOverride dans ComfyUI-KJNodes.
Texte vers vidéoInstallez le nœud ComfyUI-Spectrum-MiniMax-H3 de xmarre : la prédiction spectrale saute des évaluations du transformer et génère MiniMax H3 ~30 % plus vite dans ComfyUI.
Texte vers vidéoTéléchargez les quants MiniMax H3 pour ComfyUI : GGUF Q2-Q5 (MiniMax-H3-FL2VA-Q3_K_M/Q4_K_M, GGUFs d'encodeur), INT4/INT8 élagués et NVFP4 avec flux de travail.
minimax-h3-community-license-agreement
Texte vers vidéoEntraînez des LoRAs MiniMax H3 avec Ostris AI Toolkit : support T2V et I2V, quantification NVFP4 et points de contrôle de gradient VAE pour GPU grand public.
Open-Weights
Texte vers vidéoTéléchargez les poids ouverts de MiniMax H3 pour ComfyUI : checkpoints FL2VA et Ref2VA, fichiers bf16, INT8, pruned et NVFP4, plus six workflows (T2V, I2V, R2V).
Open-Weights
Texte vers imageLe SenseNova-U1.5-8B-MoT-Preview de SenseTime propose la génération texte-image 4K et une édition renforcée dans un modèle unifié, avec support ComfyUI via le nœud SenseNova_U1.
Apache-2.0
Des LoRA d'édition d'image qui transforment une image de personnage en fiches de référence TripleView et QuadView, avec des workflows ComfyUI inclus pour FLUX.2 Klein 9B et Krea 2.
Civitai-Model-License
Lodestones publie Kroma v0.1, un LoRA Krea 2 de rang 256 prêt pour ComfyUI, avec des deltas de norme et de modulation entièrement fine-tunés. Fonctionne avec Krea 2 base et Turbo.
MIT
Texte vers vidéoMiniMax lance H3, un modèle vidéo omni-modal qui génère des clips 2K de 15 secondes avec audio stéréo natif, compréhension du contexte multimodal et édition par instructions.
Open-Weights
Une distillation 1,4B en 6 couches de SeedVR2-7B apporte la mise à l'échelle 4x/8x en une étape aux machines à faible VRAM, avec un nœud ComfyUI prêt à l'emploi et workflow inclus.
Apache-2.0
PrunaVAED est un decodeur VAE de remplacement pour LTX-2.3 offrant un decodage 1.7x plus rapide et environ 50 pourcent de VRAM en moins.
ltx-2
Édition vidéoEyeline-Labs ID-V2V, un modèle de vidéo-à-vidéo préservant l'identité présenté à SIGGRAPH Asia 2026, dispose désormais d'un support ComfyUI grâce aux poids int8 convrot de Kijai et d'une PR principale.
NVIDIA publie Qwen-Image-Flash, une version distillée DMD2 en 4 étapes de Qwen-Image qui conserve l'architecture de base pour une génération texte-image rapide.
nvidia-open-model-license
Texte vers vidéoBlack Forest Labs dévoile FLUX 3, un modèle de base multimodal unifié générant des vidéos de 20 secondes avec son natif, des images et la prédiction d'actions pour la robotique.
API-Only
Texte vers imageMicrosoft Asia publie Mage-Flow -- compact stack 4B pour texte-image et edition d'images, resolution native 512-2048, variantes RL et Turbo, licence MIT.
MIT
NVIDIA publie Cosmos3-Edge, un modèle de monde MoT de 4B générant vidéo, images et audio à partir de texte et d'images, avec des nœuds ComfyUI.
OpenMDW-1.1
Image vers imageDamkohler a publié JLC Flux2 ControlNet v1.0.0, un ControlNet pour FLUX.2 dans ComfyUI avec composition multi-branche, conditionnement par référence et in/out-painting.
Oasis Suite v1.5 transforme Image Oasis en un pack de trois nœuds, ajoutant Video Oasis Viewer pour la prévisualisation et LTX2.3 Oasis pour la génération vidéo LTX 2.3 tout-en-un.