MiniMax 音乐制作工具包:在 ComfyUI 中打造完整音乐工作室

ComfyUI Wikinews

一个免费、采用 MIT 许可证的节点包,可将 ComfyUI 变成 MiniMax 音乐 3 制作工作室:由 LLM 编写歌曲提示词、内置 62 种曲风预设、通过 FlashSR upscaling 将音频提升至 48 kHz,并能自动生成 FLUX.2 封面图。

ComfyUI-MiniMax-Music-Production-ToolkitGitHub)是一个免费、采用 MIT 许可证的节点包,可将 ComfyUI 变成面向 MiniMax 音乐 3 的完整音乐制作环境:由本地 LLM 撰写的结构化歌曲提示词、音频增强链、自动封面图,以及可复现的制作 JSON,一切都完全在本地完成。
MiniMax 音乐制作工具包工作流

完整制作链路:LLM 歌曲规划、MiniMax 音乐 3 生成、音频增强与 FLUX.2 封面图,全部整合在一个工作流中。

无需学习提示词格式即可生成歌曲提示词

无需再手写 MiniMax 音乐 3 的描述(caption)与歌词:你只需从下拉菜单中选择所需内容,包括曲风、速度、调号、语言、声音、歌词模式与目标时长。接着,本地 LLM(任意 GGUF 模型均可,通过内置的 llama.cpp 聊天节点加载,例如 Qwen 或 Gemma)会写出完整的歌曲方案:描述、歌词、标题,甚至封面图提示词。

结构化解析器会从 LLM 响应中提取 [Caption][Lyrics][Title][Image_Prompt];如果关闭 LLM 部分,也可使用手动填写字段作为后备。内置的 62 种曲风预设库(EDM、house、金属、民谣、古典等)自带元数据,能自动预填所有字段。

音频增强链

这个工具包的主打卖点是:经过一条固定的处理链之后,输出在听感上明显优于 MiniMax 音乐 3 的原始输出。处理链包含:

  • 去削波 / 过载修复:在进一步处理之前,对硬削波的波形顶部做保守重建。
  • PRE/POST 低通滤波:在增强处理前后对信号做频带限制,防止伪影混入输出。
  • FlashSR 超分辨率:内置的 FlashSR 节点会将音频 upscale 至 48 kHz,取代了早期版本中使用的外部 Egregora 节点;权重只在首次使用时下载。
  • 混合分频与镲片/光泽(shimmer)修复:混合原始信号与超分辨率信号,在保留音头(attack)的同时,削弱带水感(watery)的高频延音。
  • 发布准备:只做静态 LUFS/真实峰值增益与重采样,不使用压缩器,也不做随时间变化的响度自动调节。

输出以 FLAC/MP3/WAV 格式保存,并带有规范的 [Album] - [Title] 命名和内嵌标签,同时还会生成一份制作 JSON,日后可借此重新生成或修改任意一首歌曲。同一份 JSON 也驱动着 GitHub Pages 上包含 25 首歌曲的演示目录;作者的 SoundCloud 合辑 里有完整长度的示例。

v2.0 起完全自包含

2.0.1 版移除了最后一批外部节点依赖:集成的 MiniMaxFlashSRAudioMiniMaxLLMChatMiniMaxLLMUnload 节点让示例工作流只需工具包节点和核心节点。其他新增功能还包括:FLUX.2 封面图分支(方形封面,尺寸同时控制内嵌封面图的分辨率)、通过 models_config.json 声明式自动下载模型、多 GPU 支持(可将 LLM 放到独立显卡上),以及自动迁移 2.0 之前保存的工作流。

安装方式

在 ComfyUI Manager 中搜索 “MiniMax Music Production Toolkit” 即可安装。和所有 MiniMax 音乐 3 环境一样,你需要准备 MiniMax 音乐 3 模型文件,外加一个用于提示词阶段的本地 LLM GGUF 模型;其余内容都会自动下载。

评论

使用 GitHub 登录后即可参与讨论。

评论加载中…
MiniMax 音乐制作工具包:在 ComfyUI 中打造完整音乐工作室 | ComfyUI Wiki