MiniMax Music 3 本地部署:免费文本生成音乐

本文详细介绍了 MiniMax Music 开源音乐模型的本地部署与使用教程。该模型是目前效果最好的开源音乐生成模型之一,满血版仅 9.8G,量化版仅 2.5G,可在消费级 GPU 上流畅运行,一次生成最长五分钟的完整歌曲(含前奏、副歌等)。文章手把手指导用户下载安装最新版 ComfyUI,配置主模型(FP16/Int8)、文本编码器和 VAE 模型,导入官方工作流,并通过填写音乐风格描述和歌词快速生成音乐。实测生成 60 秒音乐仅需数十秒,三分钟歌曲约一分钟。同时支持中文歌词,并可借助 ChatGPT/DeepSeek 等 AI 辅助编写歌词与编曲。所有资源完全免费开源,生成的音乐无版权限制,适合创作者无限使用。

Minimax Music 3-本地部署-视频教程

大家好,这里是零度解说。您现在听到的这首歌,它完全是由开源的模型本地生成的,无任何限制,完全免费。因为就在前几天,MiniMax Music 正式开源发布,这应该是目前声音效果最好的开源音乐模型了。关键是它非常小巧,完整的满血版模型只有 9.8G 左右,量化的 Int8 版本仅仅只有 2.5G,也就意味着,你几乎可以在任何消费级 GPU 上生成完整连贯的自然人声歌曲,而且一次性可以生成五分钟左右。我们只要给它歌词和一段风格描述,像前奏、副歌、桥段、完整歌曲,轻松帮我们搞定。官方还开源了一千多个模板和扩写技能,生成音乐无任何版权问题,自己生成放心用,而且是完全免费的。同时,你还可以将生成的歌曲上架到音乐平台来赚取广告费或者打赏等等。

现在我们就来说一下如何进行本地部署使用。


第一步:下载并安装最新版 ComfyUI

在开始之前,首先我们需要打开零度博士这篇文章(链接我放在视频下方)。打开以后往下拉。

首先第一步,我们需要下载安装最新版本的 ComfyUI。目前只有最新版本才支持。下载完成后进行安装。打开以后,咱们上面有个登录按钮,我们给它下载下来。下载按钮,给它保存到桌面上,总共大小是一百五十兆左右。下载好以后,然后进行安装。如果你是新手的话,那么建议你默认安装就可以了。

安装完成以后打开它,启动一下。如果你之前已经安装过 ComfyUI 客户端的话,那么它可能会提示你进行升级,一定要升级到最新版本才可以。

Minimax Music 3-ComyiU-一键整合包下载


第二步:下载模型文件

当它升级完成以后,我们重新返回到教程页面,来下载模型。

首先,我们需要把主模型给下载下来,就是 Diffusion Models。它上面总共有两个版本:

  • 第一个是满血版(FP16 精度),适合显存 8G 左右及以上的显卡。

  • 第二个是 Int8 量化版,大小约 2.5G,适合显存低于 4G 的显卡。

如果你不确定,那么把两个模型都下载下来也可以。

下载好这两个主模型以后,我们需要放到指定模型文件夹。打开我的电脑,如果你是默认安装的话,那么打开 C 盘,进入「用户」文件夹,在里面找到自己的用户名(如果不知道用户名,可以在任务管理器→用户中查看)。打开用户名文件夹后,点击上方的「查看」,勾选「隐藏的项目」,这样就可以看到 AppData 文件夹了。打开它,然后进入 Local 文件夹,再进入 ComfyUI 文件夹,接着进入 ComfyUI 的共享文件夹(即 ComfyUI 目录下的 models 文件夹)。在 models 目录下有一个 diffusion_models 文件夹,这就是存放主模型的位置。打开它,把刚才下载好的主模型文件拖进来即可。

接下来下载第二个模型文件——文本编码器(Text Encoder)。点击下载,下载完成后,重新回到刚才的 models 文件夹,在根目录下有一个 text_encoders 文件夹,打开它,把文本编码器模型放进去。

最后下载 VAE 编码器,同样下载后,回到 models 文件夹,找到 vae 文件夹,打开并放进去。这样,全部四个模型文件就放置完成了。


第三步:导入工作流

关闭文件夹,然后获取工作流文件。重新回到教程页面,把工作流文件下载下来。下载完成后,打开 ComfyUI 客户端,点击上方「创建空白工作流」按钮(加号),创建成功后,把刚才下载的工作流文件直接拖进去即可。这样工作流就加载好了,不会出现任何报错。

Minimax Music 3-开源音乐模型-免费文本生成音乐


第四步:使用与生成歌曲

工作流中的上方文本框是「音乐描述」部分,主要是告诉模型这首歌应该怎么唱、怎么编曲。下方文本框是「歌词」,即模型需要生成的内容。官方默认提供了模板歌词。再下方是「歌曲长度」,默认是 60 秒,如果想生成更长,直接修改数值即可。

点击运行按钮开始生成。生成速度非常快——当前演示没有任何加速,生成一段 60 秒的音乐大约只要几十秒。我们来听一下效果(英文歌曲,效果不错)。

接下来我们生成一首中文歌曲。在上方修改音乐描述,在下方输入中文歌词(提示词我会放到视频描述中)。然后把时长从 60 秒改成 180 秒(三分钟左右)。点击运行,开始生成。因为我的显卡是 24G 显存,跑三分钟歌曲大约只需三十到五十秒(我跑的是满血版模型)。如果你不知道如何设计歌词或音乐风格,完全可以通过 AI 辅助,比如用 ChatGPT 或 DeepSeek 帮你写歌词、编曲,最后把提示词填入即可,然后通过本地模型无限生成你需要的歌曲。

生成完成后,我们来试听效果。这里提醒一下:如果你的显存较低,可以在下方把主模型从 FP16 全精度切换到 Int8 量化版本,这样对显存要求更低,但生成效果肯定不如全精度版。

我们再试一个女生版的歌曲,点击生成,听一下前奏和副歌效果(歌词示例:窗外的雨下了一整夜…)。通过这种本地模型,你可以完全免费生成任何有趣的音乐,不受限制,想生成多少就生成多少。我们再来听另一首女生版(歌词:路灯拉长了影子…)。生成后可以直接点击下载保存。

现在我有个疑问:目前使用的提示词和音乐风格是由 Kimi 生成的,现在换成 DeepSeek 来试一下,因为毕竟要生成中文歌曲。下面就用 DeepSeek 生成的歌曲风格和歌词来创作一首歌。点击运行,这次测试更长的五分钟(300 秒),预计生成时间约两分钟(此处快进)。生成完成后,虽然我设置了五分钟,但实际因为歌词不够长,生成了三分钟零九秒。我们听一下效果(歌词:路灯拉长了影子…)。听完感觉如何?当歌曲描述、曲风和歌词全部用中文,效果也一样好。最后,如果我们把生成的歌曲配上合适的编曲或伴奏,效果会更佳。

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注

本站所有资源版权均属于原作者所有,这里所提供资源均只能用于参考学习用,请勿直接商用。若由于商用引起版权纠纷,一切责任均由使用者承担。更多说明请参考 VIP介绍。

最常见的情况是下载不完整: 可对比下载完压缩包的与网盘上的容量,若小于网盘提示的容量则是这个原因。这是浏览器下载的bug,建议用百度网盘软件或迅雷下载。 若排除这种情况,可在对应资源底部留言,或联络我们。

对于会员专享、整站源码、程序插件、网站模板、网页模版等类型的素材,文章内用于介绍的图片通常并不包含在对应可供下载素材包内。这些相关商业图片需另外购买,且本站不负责(也没有办法)找到出处。 同样地一些字体文件也是这种情况,但部分素材会在素材包内有一份字体下载链接清单。

如果您已经成功付款但是网站没有弹出成功提示,请联系站长提供付款信息为您处理

源码素材属于虚拟商品,具有可复制性,可传播性,一旦授予,不接受任何形式的退款、换货要求。请您在购买获取之前确认好 是您所需要的资源