多模态一个免费、采用 MIT 许可证的节点包,可将 ComfyUI 变成 MiniMax 音乐 3 制作工作室:由 LLM 编写歌曲提示词、内置 62 种曲风预设、通过 FlashSR upscaling 将音频提升至 48 kHz,并能自动生成 FLUX.2 封面图。
ComfyUI 生态最新动态:开源模型发布、自定义节点、工作流与工具更新。
多模态一个免费、采用 MIT 许可证的节点包,可将 ComfyUI 变成 MiniMax 音乐 3 制作工作室:由 LLM 编写歌曲提示词、内置 62 种曲风预设、通过 FlashSR upscaling 将音频提升至 48 kHz,并能自动生成 FLUX.2 封面图。
文生视频高德(AMap)开源 DreamX-Creator 1.0,一款基于 Wan2.2 构建的 7B 联合音视频生成器,具备门控跨模态注意力与 1 步 2K 精炼器,权重可以完整下载。
文生视频新增的 ComfyUI 节点将 MiniMax H3 Qwen3-VL 条件缓存至磁盘:使用相同提示词重复运行时跳过 14.6 GB 编码器,条件处理时间从 29.9 秒降至 1.1 秒。
文生视频OpenVDN 为 MiniMax H3 推出的 Video DeltaNet 混合注意力模型可在 8 步内渲染 14.4 秒 768p 视频片段,社区 ComfyUI 移植版已可用。
minimax-h3-community-license-agreement
图生视频新工作流结合 H3 Motion Context 与 Latent 保存节点,将 MiniMax H3 片段链接成无限制长度视频,支持唇形同步,可在 12GB GPU 上运行。
文生图
图生图VibeComfy 将 ComfyUI 工作流 JSON 转换为可编辑的 Python,供 CLI 智能体使用,现在与 Hivemind 知识库配对,提供社区来源的工作流模式。
图生图Provcheck v1.4.0 为 ComfyUI 带来离线 C2PA 签名节点:用于图像和音频的神经水印,以及绑定到您 Bluesky 账号的内容凭证。
图像编辑
图生图一个实验性 ComfyUI 节点通过 D3D12 桥接器在进程内运行 NVIDIA DLSS 5 神经渲染,无需离开工作流即可增强图像和视频帧。
文生视频一个来自 ComfyUI 社区的盲测 A/B 竞技场,对 23 个 MiniMax H3 加速变体进行排名:FastH3、H3 Turbo 蒸馏、SLA、PDD 及合并模型,基于 4000 个预生成片段的投票。
图生视频H3-World 将 MiniMax H3 转变为交互式世界模型:65.6M LoRA 加上注意力补丁将 WASD 和相机键映射为从单帧生成的动作控制视频。
apache-2.0
文生图开源 C++20 编译器用于 diffusion 模型,在 RTX 3090 Ti 上将 Krea 2 Turbo 提示词转 PNG 的速度比 ComfyUI 快 2 倍以上,MiniMax H3 进行中。
vh5tape 使 MiniMax H3 视频素材呈现出磨损的 1980 年代 VHS 录像效果,包含跟踪噪波、色度溢出及匹配的磁带嘶声。支持三种由提示词控制的损坏等级。
文生视频KoshiMazaki 发布 AKUSPACE v0.5,这是一款针对 LTX-2.5 的空间音频 LoRA,可将已生成的语音和音乐置于房间、俱乐部、大教堂或户外环境中,并包含 ComfyUI 节点。
文生视频HR Endless Sampler 是一个 ComfyUI 自定义节点,通过将推理拆分为多个片段来渲染无限长度的 MiniMax H3 视频,并使用 Gemma 保持连续性。
文生视频MATLOWAI 将 H3 turbo 和 Mystic LoRA 整合进单个 INT8 ConvRot ComfyUI 文件:支持 4 步文生图、图生视频及参考生视频并含音频,节省约 21 GB VRAM。
minimax-h3-community-license-agreement
文生视频rzgar 将字节跳动的 Bernini-Diffusers-v2 语义规划器和 Wan2.2 渲染器打包为 ComfyUI 自定义节点,包含 FP8 和 NVFP4 权重及一个适用于六项任务的单一工作流。
apache-2.0
文生视频Fizgig v5.0.0 带来 MiniMax H3 33B 和 Krea 2 12.9B 基础模型的全量微调,支持低至 16 GB 显存的消费级 GPU,并包含用于 ComfyUI 的 Checkpoint 转 LoRA 导出器。