语音合成哔哩哔哩 IndexTeam 发布 IndexTTS-2.5:支持中文、英语、日语、西班牙语和阿拉伯语的零样本声音克隆,并具备情感和语速控制功能。
Bilibili Model License
ComfyUI 生态最新动态:开源模型发布、自定义节点、工作流与工具更新。
语音合成哔哩哔哩 IndexTeam 发布 IndexTTS-2.5:支持中文、英语、日语、西班牙语和阿拉伯语的零样本声音克隆,并具备情感和语速控制功能。
Bilibili Model License
文生视频Unsloth 发布 MiniMax H3 的 GGUF 量化版本,涵盖 FL2VA 和 Ref2VA 从 Q2_K(6.3 GB)到 Q8_0(20 GB)的完整范围,以及 Qwen3-VL 文本编码器 GGUF,适用于 ComfyUI 和 stablediffusion.cpp。
文生图iljung1106 的新 ComfyUI 节点将归一化注意力引导引入 Krea 2,恢复了对需要 CFG 1.0 的 Turbo 模型上的负面提示控制。
文生视频下载 h3-realism-people-t2v-i2v-r2v.safetensors(125 MB)放入 ComfyUI/models/loras,即可在 T2V、I2V 和 R2V 中生成照片级真实人物,触发词为 r34l1sm。
从 GitHub 安装 MiniMax H3 官方技能:h3-prompt-writing 覆盖全部五种生成模式,另有 8 款风格化视频生成技能,均附带双语 SKILL.md 文件。
Redis 的创造者 antirez 构建了 h3.c,这是一个基于 Metal 的原生 MiniMax-H3 推理引擎,专为 Apple Silicon 设计,提示词转视频/音频和 Ref2VA 参考功能均可端到端运行。
MIT
文生视频一个 ComfyUI 自定义节点用 Qwen3-VL-4B 加上学习到的投影替换了 MiniMax H3 的 15.7 GB Qwen3-VL-32B 文本编码器,将条件 VRAM 降至 4.5 GB。
MIT
局部重绘LanPaint 2.0.0 新增 MiniMax H3 支持,提供视频与音频修复流水线:在一个编辑器中绘制逐帧遮罩和音频区间,然后一次性完成两者的修复。
Lodestones 以完整的 Krea 2 微调 checkpoint 形式发布 Kroma v0.2,而非 LoRA。提供 base 与 turbo 文件,并附有适用于 ComfyUI 的社区 INT8 量化版本。
MIT
视频编辑H3 Motion Context v0.2.0 可串联 MiniMax H3 片段,让动作和音频在切换处无缝延续,新增参考模式支持,并消除拼接处的可见接缝。
下载 h3_clean_latent_upscaler_v1_mamad8.safetensors(56 MB):Mamad8 为 MiniMax H3 推出的 2x 干净 Latent 放大模型,配备两个 ComfyUI 节点,可在 VAE 解码前将空间分辨率提升一倍,全程保持在 Latent 空间中。
文生视频下载 minimax_h3_turbo_v4_step600_ema.safetensors(MiniMax H3 Turbo LoRA v4):在 ComfyUI 中实现 2 步音视频生成,支持剪枝 checkpoint。
下载 minimax_h3_t1_image_vae_step1597.safetensors(5.2 GB):Mamad8 发布的实验性图像专用 MiniMax H3 VAE,可将单个 T=1 时间 Latent 直接解码为图像,无需自定义节点。
文生视频Lightx2v 的 MiniMax-H3-Prompt-Rewriter-LoRA 可在本地将简短提示词转换为结构化的 H3 T2VA 描述,并提供适用于 Qwen3.6-27B 适配器的 ComfyUI 节点包。
角色动画阿里巴巴通义实验室发布 Wan-Animate-2 与 Wan-Animate-2-Lite:端到端角色动画,直接消费驱动视频,支持文本驱动视角控制与原生 ComfyUI 节点;Lite 版支持实时流式动画。
Apache-2.0
图生视频Lightx2v 与 ModelTC 将 MiniMax H3 蒸馏为 4 步 FL2V Turbo LoRA,将采样步数从约 20 步降至 4 步,并提供 ComfyUI 转换与演示 Spaces。
文生视频下载 MiniMax H3 Turbo LoRA(minimax_h3_turbo_4step_ckpt500.safetensors):在 ComfyUI 中 4 步生成带同步立体声音频的视频,另附剪枝转换版与文生视频、图生视频工作流。
Apache-2.0
文生视频tsuremen 的新 ComfyUI 节点会在 MiniMax H3 调度的前几步中试跑多个种子,在节点上直接显示实时预览,并且只完成你选中的种子。
文生视频下载 Kijai 的实验性 w4a8 量化 MiniMax H3 权重用于 ComfyUI:minimax_h3_fl2va_pruned_w4a8_mixed.safetensors(12.5 GB FL2VA)、Ref2VA 变体及 int8 convrot VAE。
minimax-h3-community-license-agreement
文生视频Sand.ai 开源 MAGI-2 Preview,这是一个 114B 参数的 MoE 模型,可将文本或图像转换为带有同步音频的 10 秒视频,每个 token 仅激活 6B 参数。
Apache-2.0