Edición de vídeoJD Open Source publica JoyAI-Video-Edit, un modelo de difusión autoregresivo de 16B que edita flujos de vídeo en vivo en tiempo real a 30 FPS y 720p.
Apache-2.0
Novedades del ecosistema ComfyUI: lanzamientos de modelos de código abierto, nodos personalizados, flujos de trabajo y herramientas de generación de imagen, video y audio.
Edición de vídeoJD Open Source publica JoyAI-Video-Edit, un modelo de difusión autoregresivo de 16B que edita flujos de vídeo en vivo en tiempo real a 30 FPS y 720p.
Apache-2.0
Texto a imagenUn LoRA clásico de ControlNet OpenPose para Krea 2 Turbo: proporciona un mapa de esqueleto DWPose y el modelo sigue la pose mientras el prompt define la apariencia.
Apache-2.0
Texto a vídeoDescarga taeh3.safetensors (TAE de MiniMax H3) para previsualizar vídeo rápido en ComfyUI. Un pequeño autoencoder 2D que se usa con ModelPreviewOverride en ComfyUI-KJNodes.
Texto a vídeoInstala el nodo ComfyUI-Spectrum-MiniMax-H3 de xmarre: la predicción espectral omite evaluaciones del transformer y genera MiniMax H3 ~30% más rápido en ComfyUI.
Texto a vídeoDescarga los quants de MiniMax H3 para ComfyUI: GGUF Q2-Q5 (MiniMax-H3-FL2VA-Q3_K_M/Q4_K_M, GGUFs de codificador de texto), INT4/INT8 podados y NVFP4 con workflows.
minimax-h3-community-license-agreement
Texto a vídeoEntrena LoRAs de MiniMax H3 con Ostris AI Toolkit: soporte T2V e I2V, cuantización NVFP4 y checkpoints de gradiente de VAE para GPUs de consumo.
Open-Weights
Texto a vídeoDescarga los pesos abiertos de MiniMax H3 para ComfyUI: checkpoints FL2VA y Ref2VA, archivos bf16, INT8, pruned y NVFP4, más seis plantillas de workflow oficiales (T2V, I2V, R2V).
Open-Weights
Texto a imagenEl SenseNova-U1.5-8B-MoT-Preview de SenseTime ofrece generación de imagen 4K por texto y edición más sólida en un modelo unificado, con soporte ComfyUI vía el nodo SenseNova_U1.
Apache-2.0
LoRAs de edición de imágenes que convierten una imagen de personaje en hojas de referencia TripleView y QuadView, con workflows ComfyUI incluidos para FLUX.2 Klein 9B y Krea 2.
Civitai-Model-License
Lodestones lanza Kroma v0.1, una LoRA de rango 256 lista para ComfyUI para Krea 2, con deltas de norma y modulación totalmente fine-tuneados. Funciona con Krea 2 base y Turbo.
MIT
Texto a vídeoMiniMax lanza H3, un modelo de vídeo omni-modal que genera clips 2K de 15 segundos con audio estéreo nativo, comprensión de contexto multimodal y edición por instrucciones.
Open-Weights
Una destilación de 6 capas y 1.4B de SeedVR2-7B lleva la ampliación 4x/8x de un solo paso a máquinas con poca VRAM, con un nodo ComfyUI de instalación directa y workflow listo.
Apache-2.0
PrunaVAED es un decodificador VAE de reemplazo para LTX-2.3 que ofrece una decodificación 1.7x más rápida y aproximadamente un 50% menos de VRAM máxima.
ltx-2
Edición de vídeoEyeline-Labs ID-V2V, un modelo de video a video que preserva la identidad de SIGGRAPH Asia 2026, ahora tiene soporte en ComfyUI a través de los pesos int8 convrot de Kijai y un PR principal.
NVIDIA publica Qwen-Image-Flash, una versión de Qwen-Image destilada con DMD2 en 4 pasos que conserva la arquitectura base para generar texto a imagen rápido.
nvidia-open-model-license
Texto a vídeoBlack Forest Labs presenta FLUX 3, un modelo fundacional multimodal unificado que genera video de 20 segundos con audio nativo, imágenes y predicción de acciones para robótica.
API-Only
Texto a imagenMicrosoft Asia lanza Mage-Flow -- compacto stack 4B para texto a imagen y edicion, resolucion nativa 512-2048, variantes RL y Turbo, licencia MIT.
MIT
NVIDIA lanza Cosmos3-Edge, un modelo de mundo MoT de 4B que genera vídeo, imágenes y audio desde texto e imágenes, con nodos ComfyUI.
OpenMDW-1.1
Imagen a imagenDamkohler lanzó JLC Flux2 ControlNet v1.0.0, un ControlNet para FLUX.2 en ComfyUI con composición multi-rama, acondicionamiento por referencia y soporte para in/out-painting.
Oasis Suite v1.5 expande Image Oasis a tres nodos, añadiendo Video Oasis Viewer con vista previa en el nodo y LTX2.3 Oasis para generación de video LTX 2.3 todo en uno.