源码系统概览
本项目是 MiniMax 官方开源的 Music 3 音乐生成技能包,核心交付 music-caption-rewriter 提示词重写技能与 1000 套风格化提示词模板。
文章正文
本站提供的这套源码免费下载,内容是 MiniMax 官方开源的 Music 3 智能体技能包。
技能包能把简短的音乐描述与带章节标签的歌词,改写成包含全局元数据、人声细节与编曲排布的 Music 3.0 结构化提示词。
改写结果可直接作为音乐生成接口的指令参数,配合 MiniMax Music 3 生成最长五分钟的完整歌曲。
技术架构与部署指南
源码简介
MiniMax Music 3 是面向完整歌曲生成的音乐模型,可依据歌词与详细音乐描述,生成结构连贯、人声自然、时长可达五分钟的歌曲。
模型采用混合大语言模型架构,由 8B 全局模型负责长程结构与语义,0.6B 局部模型负责逐帧声学细节,再经 Flow Matching 与 Flow-VAE 连续隐状态合成输出 32kHz 双声道立体声。
本仓库交付的是提示词增强层的智能体技能包,包含技能指令文件、风格路由入口、18 个风格族索引与 1000 套完整提示词模板。
技能包面向 Claude Code、Cursor、Codex 等编码智能体,通过渐进式检索只读取所需模板,无需外部接口与运行依赖。
适用场景
适用于使用 MiniMax Music 3 接口进行音乐创作的创作者与开发者,可把口头风格描述快速转成精确的生成指令。
适合需要批量制作歌词配曲、分章节编曲设计的音乐生产流程。
也适合 AI 编程助手用户,在提示词工程、音乐生成提示词教学与风格融合实验场景中使用。
| 维度 | 本套源码 | 同类通用方案 |
|---|---|---|
| 技术栈 | 技能包本体为纯文本资源,使用 Markdown 与 YAML 格式组织,无编译过程与第三方运行依赖。 | 依具体方案选型,需自行搭建与维护 |
| 部署方式 | 推荐使用 npx skills add 命令从仓库根目录一键安装音乐提示词重写技能。 | 多托管于第三方平台或订阅云服务 |
| 功能侧重 | 输出采用三层结构,全局元数据、人声细节与逐章节编曲时间线覆盖音乐生成的关键控制维度。 | 功能通用,定制深度有限 |
| 数据归属 | 数据自持,部署在自有服务器,不出站 | 数据通常留存于服务商侧 |
| 成本模式 | 获取后自主部署,无持续授权费用 | 通常按订阅或调用量计费 |
技术栈与运行环境
技能包本体为纯文本资源,使用 Markdown 与 YAML 格式组织,无编译过程与第三方运行依赖。
安装技能后需在支持 Skills 协议的编码智能体中调用,技能调用名称为 music-caption-rewriter。
若需实际生成音频,需另行接入 MiniMax Music 3 模型服务,模型推理建议配置两张 CUDA GPU。
功能亮点
输出采用三层结构,全局元数据、人声细节与逐章节编曲时间线覆盖音乐生成的关键控制维度。
内置 1000 套完整提示词模板与 18 个风格族索引,覆盖流行、嘻哈、金属、爵士、民谣、东亚现代等主流风格。
支持保留歌词中的章节标签,将 Intro、Verse、Chorus、Bridge 等标记转译为编曲指令,歌词原文不做改写。
采用渐进式检索机制,先按风格路由到目标风格族再读取所选模板,资源占用小且输出可控。
安装与部署提示
推荐使用 npx skills add 命令从仓库根目录一键安装音乐提示词重写技能。
也可手动将技能目录复制到智能体技能目录,目录名需保持 music-caption-rewriter 不变。
生成服务可使用 SGLang-Omni 启动,接口遵循共享语音协议,歌词填入 input 字段、音乐描述填入 instructions 字段。
截图与演示说明
项目根目录提供仓库横幅图与模型架构示意图,分别展示项目视觉标识与混合大语言模型的音频合成流程。


两张截图均取自项目根目录的图片目录,图 1 为仓库横幅,图 2 为模型架构示意图。
仓库还内置一段示例音频,可直观感受模型生成的完整歌曲效果。
常见问题
问这套源码免费下载后是否需要安装模型权重?
技能包本身不包含模型权重,模型参数需按仓库指引另行下载,技能只负责提示词改写。
问music-caption-rewriter 支持哪些编程智能体?
技能按 Skills 协议编写,可安装到 Claude Code、Cursor、Codex 等支持该协议的智能体中。
问改写后的提示词如何用于音乐生成?
把改写结果填入生成接口的 instructions 字段,原始歌词保留在 input 字段即可。
问生成完整歌曲需要什么硬件条件?
仓库说明指出推理需要两张 CUDA GPU,当前仅支持非流式生成。
安全风险提示
深度扫描未发现后门、混淆代码、硬编码凭据或危险命令,全部 1000 余个文件均为纯文本模板与文档。
项目为静态文本资源,不执行脚本也不上传数据,按官方说明安装使用即可放心。
下载说明
本页提供的源码资源仅供学习与技术研究使用,请遵守 MiniMax 官方许可条款与模型使用规范。
使用音乐生成能力需自行接入官方服务并按官方规则执行,下载内容以官方仓库原样为准。
如资源或链接有误,请以官方仓库最新版本为准。
GitHub项目开源地址:https://github.com/MiniMax-AI/MiniMax-Music3