Texto a vozBilibili IndexTeam lanza IndexTTS-2.5: clonación de voz zero-shot en chino, inglés, japonés, español y árabe, con control de emociones y velocidad.
Bilibili Model License
Novedades del ecosistema ComfyUI: lanzamientos de modelos de código abierto, nodos personalizados, flujos de trabajo y herramientas de generación de imagen, video y audio.
Texto a vozBilibili IndexTeam lanza IndexTTS-2.5: clonación de voz zero-shot en chino, inglés, japonés, español y árabe, con control de emociones y velocidad.
Bilibili Model License
Texto a vídeoUnsloth publica cuantizaciones GGUF de MiniMax H3 de Q2_K (6,3 GB) a Q8_0 (20 GB) para FL2VA y Ref2VA, más GGUF del codificador Qwen3-VL para ComfyUI y stablediffusion.cpp.
Texto a imagenEl nuevo nodo de ComfyUI de iljung1106 incorpora la Guía de Atención Normalizada a Krea 2 y restaura el control del prompt negativo en los checkpoints Turbo que requieren CFG 1.0.
Texto a vídeoDescarga h3-realism-people-t2v-i2v-r2v.safetensors (125 MB) en ComfyUI/models/loras para generar personas fotorrealistas en T2V, I2V y R2V con la palabra clave r34l1sm.
Instala los skills oficiales de MiniMax H3 desde GitHub: h3-prompt-writing para los cinco modos de generación y ocho skills de vídeo por estilo con archivos SKILL.md bilingües.
antirez, creador de Redis, construye h3.c, un motor de inferencia MiniMax-H3 nativo para Apple Silicon con vídeo/audio y Ref2VA de extremo a extremo.
MIT
Texto a vídeoUn nodo de ComfyUI sustituye el codificador Qwen3-VL-32B (15,7 GB) de MiniMax H3 por un Qwen3-VL-4B con proyección aprendida, reduciendo la VRAM de acondicionamiento a 4,5 GB.
MIT
InpaintingLanPaint 2.0.0 añade soporte para MiniMax H3 con un pipeline de relleno de vídeo y audio: pinta máscaras e intervalos de audio en un editor y rellena ambos en una pasada.
Lodestones lanza Kroma v0.2 como un checkpoint de Krea 2 con fine-tune completo en lugar de un LoRA, con archivos base y Turbo y cuantizaciones INT8 para ComfyUI.
MIT
Edición de vídeoH3 Motion Context v0.2.0 encadena clips MiniMax H3: el movimiento y el audio continúan entre cortes, añade el modo de referencia y elimina la costura visible.
Descarga h3_clean_latent_upscaler_v1_mamad8.safetensors (56 MB): ampliador de latente 2x para MiniMax H3 de Mamad8, duplicando la resolución antes del decodificado VAE.
Texto a vídeoDescarga minimax_h3_turbo_v4_step600_ema.safetensors, el Turbo LoRA v4 de MiniMax H3: generación de audio y vídeo en 2 pasos en ComfyUI con checkpoint podado.
Descarga minimax_h3_t1_image_vae_step1597.safetensors (5,2 GB): el VAE de Mamad8 para MiniMax H3 decodifica una latente T=1 directamente en una imagen, sin nodos personalizados.
Texto a vídeoEl MiniMax-H3-Prompt-Rewriter-LoRA de Lightx2v convierte prompts cortos en descripciones T2VA estructuradas localmente, con nodos de ComfyUI para Qwen3.6-27B.
Animación de personajesWan-Animate-2 y Wan-Animate-2-Lite en ComfyUI: animación de personajes desde vídeo, control de perspectiva por texto, nodos nativos y Lite en tiempo real.
Apache-2.0
Imagen a vídeoLightx2v y ModelTC destilan MiniMax H3 en un Turbo LoRA FL2V de 4 pasos, reduciendo el muestreo de ~20 pasos a 4 con una conversión para ComfyUI y Spaces de demostración.
Texto a vídeoDescarga el MiniMax H3 Turbo LoRA (minimax_h3_turbo_4step_ckpt500.safetensors): vídeo con audio estéreo en 4 pasos en ComfyUI, con conversión pruned y workflows T2V/I2V.
Apache-2.0
Texto a vídeoEl nodo de tsuremen para ComfyUI sondea varias semillas en los primeros pasos del programa de MiniMax H3, muestra vistas previas en vivo y finaliza solo la semilla que elijas.
Texto a vídeoDescarga pesos experimentales w4a8 de MiniMax H3 de Kijai para ComfyUI: minimax_h3_fl2va_pruned_w4a8_mixed.safetensors (FL2VA de 12,5 GB), variante Ref2VA y VAE int8 convrot.
minimax-h3-community-license-agreement
Texto a vídeoSand.ai publica MAGI-2 Preview: un MoE de 114B que convierte texto o imágenes en vídeos de 10 segundos con audio sincronizado, activando solo 6B parámetros por token.
Apache-2.0