Texto a imagenShakker Labs presenta el nuevo modelo FLUX.1-dev-ControlNet-Union-Pro-2.0 con efectos de control optimizados, soporte para múltiples modos de control y tamaño de modelo reducido
Open-Weights
Novedades del ecosistema ComfyUI: lanzamientos de modelos de código abierto, nodos personalizados, flujos de trabajo y herramientas de generación de imagen, video y audio.
Texto a imagenShakker Labs presenta el nuevo modelo FLUX.1-dev-ControlNet-Union-Pro-2.0 con efectos de control optimizados, soporte para múltiples modos de control y tamaño de modelo reducido
Open-Weights
Texto a imagenInstantCharacter es un método innovador sin necesidad de ajustes que permite la generación consistente de personajes a partir de una sola imagen, compatible con diversas tareas posteriores
Open-Weights
Texto a vídeoDesarrollada por Lvmin Zhang, la tecnología FramePack comprime el contexto de los fotogramas de entrada, haciendo que la carga de trabajo de generación de vídeo sea invariable a la longitud del vídeo, permitiendo procesar numerosos fotogramas incluso en GPUs de portátiles
Open-Weights
Seaweed-7B logra un rendimiento superior a los modelos de 14 mil millones de parámetros con solo 7 mil millones, a un tercio del costo de entrenamiento de los estándares de la industria
Open-Weights
Texto a vídeoUn nuevo marco de restauración de videos FloED ha publicado su código y pesos, logrando mayor coherencia y eficiencia computacional mediante guía de flujo óptico
Open-Weights
PixelFlow opera innovadoramente en el espacio de píxeles sin procesar, simplificando el proceso de generación de imágenes sin requerir autocodificadores variacionales preentrenados, permitiendo modelos entrenables de extremo a extremo
Open-Weights
Imagen a 3DHoloPart puede descomponer modelos 3D en partes completas y semánticamente significativas, resolviendo desafíos de edición en la creación de contenido 3D
Open-Weights
Imagen a 3DUniRig utiliza modelos autorregresivos para generar estructuras de esqueleto y pesos de skinning de alta calidad para diversos modelos 3D, simplificando enormemente el flujo de trabajo de animación
Open-Weights
MultimodalOmniSVG es un nuevo modelo unificado multimodal de generación de SVG capaz de producir gráficos vectoriales altamente complejos y editables a partir de diversas entradas, incluyendo texto, imágenes o referencias de personajes
Open-Weights
Texto a vídeoInvestigadores desarrollan el modelo TTT-Video utilizando tecnología Test-Time Training basada en CogVideoX 5B, capaz de generar videos coherentes de hasta 63 segundos
MIT
Texto a imagenEl equipo de Inteligencia Creativa de ByteDance lanza el modelo UNO, desbloqueando mayor controlabilidad mediante la generación en contexto, logrando generación de imágenes de alta calidad desde sujetos individuales hasta múltiples
Open-Weights
Texto a imagenEl equipo Tiamat AI lanza el marco EasyControl, añadiendo capacidades de control condicional a los modelos DiT, ahora compatible con ComfyUI a través del plugin ComfyUI-easycontrol
Open-Weights
Texto a imagenHiDream.ai lanza HiDream-I1, un nuevo modelo de texto a imagen de código abierto con 17B parámetros que supera a los modelos existentes de código abierto en múltiples pruebas, permitiendo la generación de imágenes de alta calidad en varios estilos
Open-Weights
Imagen a 3DEl equipo Stable-X presenta Hi3DGen, un marco innovador para generar modelos 3D de alta fidelidad a partir de imágenes, abordando la falta de detalles geométricos en los métodos existentes mediante tecnología de puente normal
Open-Weights
Imagen a 3DTripoSF, basado en la innovadora representación SparseFlex, soporta generación de modelos 3D con resoluciones de hasta 1024³, capaz de manejar superficies abiertas y estructuras internas complejas, mejorando significativamente la calidad de activos 3D
Open-Weights
Texto a vídeoKunlun Wanwei lanza SkyReels-A2, el primer marco controlable de generación de vídeo de nivel comercial del mundo, que permite la generación de vídeo con múltiples elementos mediante una arquitectura de doble rama, abriendo nuevas posibilidades para el comercio electrónico, la producción cinematográfica y más
Open-Weights
MultimodalEl Laboratorio Tongyi del Grupo Alibaba presenta VACE, el primer marco unificado del mundo para diversas tareas de vídeo, que abarca desde la generación de texto a vídeo, la edición de vídeo hasta combinaciones de tareas complejas
Open-Weights
MultimodalEl proyecto StarVector implementa la generación automática de código de gráficos vectoriales SVG a partir de imágenes y texto, proporcionando nuevas herramientas creativas para diseñadores y desarrolladores.
Open-Weights
Texto a imagenByteDance presenta InfiniteYou (InfU), un innovador marco basado en Transformadores de Difusión que permite la recreación flexible de fotos mientras preserva la identidad del usuario, abordando limitaciones en métodos existentes respecto a la similitud de identidad, alineación texto-imagen y calidad de generación
MIT
Stability AI presenta un nuevo modelo de IA, Stable Virtual Camera, que puede transformar fotos comunes en videos 3D con profundidad y perspectiva realistas, ofreciendo a los creadores un control intuitivo de la cámara.
Open-Weights