M87 es un LoRA estético en vista previa temprana para Krea 2 Turbo que mejora la composición, iluminación, atmósfera y textura visual, haciendo que las generaciones se sientan más cinematográficas y dirigidas artísticamente sin fijarse en un estilo específico.
Noticias de ComfyUI y lanzamientos de IA de código abierto
Novedades del ecosistema ComfyUI: lanzamientos de modelos de código abierto, nodos personalizados, flujos de trabajo y herramientas de generación de imagen, video y audio.
Alissonerdx lanza LTX-Best-Face-ID, una LoRA de referencia a video para LTX-2 que preserva la identidad mediante condicionamiento de superposición, etiquetado de fase fuente TASS-RoPE y pérdida de identidad ArcFace. No necesita fondo blanco en ComfyUI.
Edición de imagenOstris ha añadido soporte en AI Toolkit para entrenar modelos Krea 2 con imágenes de referencia, permitiendo entrenar LoRAs de estilo edición que dominan conceptos como 'haz esto un cíclope' en solo 1.750 pasos.
MIT
Tanmay Patil publicó el Krea 2 Depth ControlNet-LoRA, añadiendo generación de imágenes condicionada por profundidad a Krea 2. Funciona tanto con Krea 2 Raw como con Turbo, alcanzando una consistencia de profundidad de 0.99 de correlación de Pearson.
Krea-2-Community
Texto a imagenFlux2-Klein-9B-True-V2 es el último fine-tune completo de wikeeyang basado en FLUX.2-klein-9B, que ofrece mejoras significativas en fotorrealismo, adherencia a las instrucciones, compatibilidad con LoRA y calidad de edición de imágenes.
FLUX-1-dev-non-commercial
Meituan lanza LongCat 2.0, un modelo de lenguaje MoE de 1.6 billones de parámetros con una ventana de contexto de 1 millón de tokens, entrenado completamente en hardware ASIC de IA. Los pesos del modelo se publicarán próximamente bajo licencia MIT.
Alissonerdx publica Edit Anything, un conjunto de LoRAs de edición de video para LTX-2.3 bajo licencia Apache 2.0, con transferencia de movimiento, edición multitarea sin referencia y video a video con referencia, todo a través de los nodos BFSnodes de ComfyUI.
Comfy MCP: Convierte tu Agente de IA en un Tecnólogo Creativo
Comfy Org lanza Comfy MCP, conectando agentes de IA a ComfyUI mediante el Model Context Protocol. Los agentes ahora pueden buscar modelos, ejecutar flujos de trabajo y generar imágenes, video y contenido 3D en lenguaje natural.
Kandinsky Lab (Sber) lanza KVAE-Audio, un autoencoder de audio continuo de 166,9 millones de parámetros que logra una calidad de reconstrucción de vanguardia en voz, música y sonido general a 48 kHz de ancho de banda completo.
ilkerzgi lanza más de 1.500 LoRAs de estilo Krea 2: una biblioteca masiva de estilos de código abierto
ilkerzgi ha publicado más de 1.500 LoRAs de estilo Krea 2 en Hugging Face, abarcando 7 categorías desde ilustración hasta fotográfico. Cada LoRA viene listo para usar en ComfyUI.
Texto a vozHiggs TTS 3 es un modelo de texto a voz de 4 mil millones de parámetros que admite más de 100 idiomas con clonación de voz zero-shot, control emocional expresivo y efectos de sonido/prosodia en línea para aplicaciones de agentes de voz.
Edición de vídeofal.ai lanzó LTX-2.3 3DREAL IC-LoRA, un LoRA in-context para LTX-Video que transforma bloqueos 3D aproximados y renders CG en vídeo fotorrealista y cinematográfico, preservando la composición y el movimiento de cámara originales.
Open-Weights
MultimodalNVIDIA publica como código abierto LocateAnything-3B, un modelo de grounding visión-lenguaje que presenta Decodificación Paralela de Cajas (PBD) para una localización rápida y precisa de objetos, compatible con detección de objetos, grounding de elementos GUI, localización OCR y grounding basado en puntos en diversos dominios.
Open-Weights
Edición de vídeoWhatDreamsCost lanza LTX Director 2.0, una actualización masiva de la herramienta gratuita de edición de video para ComfyUI que añade soporte completo de video, integración de IC-LoRA, inpainting de audio, modo retake para regeneración selectiva y una renovación total de la interfaz.
FuzzPuppy lanza LTX-2.3 Foley LoRA, un LoRA de video a audio que añade efectos de sonido realistas y sincronizados visualmente a los vídeos generados con LTX-2.3, sin superposición de música de fondo.
Imagen a vídeoEl C4G Lab de HKUST lanza DomainShuttle, un modelo de generación de video guiado por sujeto de dominio abierto con licencia Apache-2.0, construido sobre Wan2.2-T2V-14B. Incluye Domain-MoT, Video-Reference DualRoPE y Cross-Pair Consistent Loss para fidelidad intradominio flexible y transferencia de estilo transdominio.
Apache-2.0
Texto a imagenKrea.ai lanzó Krea 2 Raw y Turbo, un Transformer de Difusión de 12.9 mil millones de parámetros con pesos abiertos para generación de texto a imagen. ComfyUI lo soporta de forma nativa con flujos de trabajo listos para usar.
Krea-2-Community
Edición de imagenBoogu-Image-0.1-Edit es un modelo de edición de imágenes con licencia Apache 2.0 de la familia Boogu-Image, que ofrece edición de imágenes basada en instrucciones con una arquitectura unificada de comprensión y generación multimodal.
Apache-2.0
Texto a vozHiggs TTS 3 es un modelo de texto a voz de 4 mil millones de parámetros que admite más de 100 idiomas con clonación de voz zero-shot, control emocional expresivo y efectos de sonido/prosodia en línea para aplicaciones de agentes de voz.
Open-Weights
Texto a vídeoSulphur 2 es un ajuste fino comunitario de LTX 2.3 que ofrece generación de video de texto a video y de imagen a video, con un mejorador de prompts integrado y un LoRA destilado, entrenado en más de 125K clips seleccionados.
Open-Weights