音乐生成工作室

作者:鹿Sir内容创作v1

从一个主题、一句歌词、一段画面或参考音频开始,用 AI 完成原创歌曲、歌词成曲、纯音乐、BGM、视频配乐、品牌音乐、广告歌、播客片头、游戏音乐和多语言歌曲创作,先确定曲风、情绪、结构、可唱歌词与人声方向,再生成可试听音频并集中优化最佳版本。当用户需要 AI 写歌、生成背景音乐、文字转音乐或创作多语言歌曲时触发。触发词:AI音乐生成、写歌、歌词成曲、BGM、纯音乐创作。

下载量
370
点赞
90
价格
免费

技能文档

---
name: music-generation-studio
title: 音乐生成工作室
category: 内容创作
description: 从一个主题、一句歌词、一段画面或参考音频开始,用 AI 完成原创歌曲、歌词成曲、纯音乐、BGM、视频配乐、品牌音乐、广告歌、播客片头、游戏音乐和多语言歌曲创作,先确定曲风、情绪、结构、可唱歌词与人声方向,再生成可试听音频并集中优化最佳版本。当用户需要 AI 写歌、生成背景音乐、文字转音乐或创作多语言歌曲时触发。触发词:AI音乐生成、写歌、歌词成曲、BGM、纯音乐创作。
---

# 音乐生成工作室

把主题、场景、歌词片段、完整歌词、功能性音乐需求或参考录音发展成一个连贯的音乐方向;当用户需要音频时,再据此发起一次意图明确的生成请求。交付物可以是歌曲、纯音乐、BGM、配乐、广告歌、多语言作品或基于参考音频的新编曲。把歌手身份、发音、精确时长、循环点、旋律延续和母带处理视为生成后需要审听的质量,而不是能够保证的属性。

先锁定曲风、结构和人声或器乐路线再生成,随机成曲不是默认工作方式。已有录音的翻唱改编、礼物定制歌、短视频循环器乐等相邻需求,请改用对应的专门技能。

硬输入是主题或歌词,加上用途。用途、曲风或人声路线为空时先收齐,不要用默认流行简报填空。

所有服务端操作都只能通过随包 `scripts/mcp_client.py` 执行。不要配置或调用外部 Connector,也不要使用 REST/OpenAPI 作为降级或回退方案。普通调用运行 `python3 scripts/mcp_client.py call <tool-name>`,并通过 stdin 传入一个 JSON 对象。本地文件只能使用专用上传命令。连接排查参见 [随包 MCP Client 连接诊断](references/mcp-connection.md)。

## 技能工作流

### 步骤1:确定创作方向

复用对话中所有已确定的选择;在安全的前提下,根据作品用途推断常规创作细节。只有缺失的信息会改变歌词、参考方向、人声或纯音乐路线、实际付费参数,或其他由用户决定且影响重大的选择时,才提问。

生成前准备一张简洁的制作卡:用途与听众;标题、核心构想、情绪变化、主要曲风、速度感、乐器、结构、混音方向、结尾或循环方向以及排除项;人声或纯音乐路线;含人声时的完整歌词、语言与语体及人声方向;所选模型及其专属控制项;涉及参考音频时的参考意图与应保留或改变的特征;以及「下一步会产生一次付费生成」的事实。

制作纯音乐时省略歌词,并在创作方向中为对白或其他功能需求留出空间。制作人声音乐时,在生成前完成并展示重要的歌词修改。已有歌词时,先整理主歌、副歌和桥的段落标签再付费。不要把 BPM、调式或速度数字塞进风格 caption。歌词创作、创意策划、模型查询、提示词准备和评析都不产生付费调用。详见 [意图与路线](references/intent-and-routing.md)、[创作需求与风格](references/creative-brief-and-style.md)、[歌词写作](references/lyrics-craft.md) 和 [人声、语言与标签](references/vocal-language-and-tags.md)。

当需求用某位艺人的简称描述风格时,将其转化为可执行的曲风、年代、速度、乐器、和声、人声质感、乐句处理和混音特征。

### 步骤2:选择并校验模型

常规生成应设置 `model: "suno-5.5"`。绝不能省略模型,也不能静默使用 `auto`。当用户要求其他模型、询问当前可用性或价格,或需要某模型的专属能力时,调用 `beatra.models.list`(能力用 `text_to_music` 或 `reference_audio_to_music`)。不要静默替换模型。

只使用所选模型系列实际返回或文档中列出的控制项,Suno 与 MiniMax 的选项不能互换。通过 [模型路线](references/model-routing.md) 校验准确参数,把 [音乐方案](references/music-recipes.md) 中的示例作为参考模式而非固定承诺。

### 步骤3:使用参考音频(如适用)

对本地 FLAC、MP3 或 WAV 参考音频,只能运行:

```text
python3 scripts/mcp_client.py upload <path> --mime-type <type>
```

随包命令会获取并校验上传授权,逐字节上传文件,并返回可用作 `reference_audio` 的产物。不要用宿主 HTTP、Connector、REST 或手写授权与 PUT 流程替代。通用上传上限 100 MB;所选音乐模型可能设置更低的限制。

说明哪些特征应当保留、哪些应当改变。参考音频用于指导新的创作结果;生成后按既定方向审听旋律、人声特征、能量、乐器和编曲。

### 步骤4:确认付费边界并生成

直接且信息完整的生成要求,只授权执行一次对应请求;用户批准完整制作卡同样只授权一次,不再要求第二次确认。估价、比较、歌词审阅、方向选择或「暂不生成」都不代表批准。

黄金路径:先锁定结构与动态弧,写好可执行 caption 和带标签歌词,再确认一次付费请求、产出有限 take。审听后只延展或替换最好的一段;不要整首自动重做或连发 Extend。

付费调用前清楚展示模型、标题、歌词或纯音乐状态、参考音频、重要控制项及单次生成范围。仅在参数最终确定后,创建 1–128 字符且稳定的 `client_request_id`。对提示词、歌词、纯音乐标记、标题、模型、参考音频、模型选项或任何其他参数的修改都构成新的付费请求,需要新标识与确认。

只提交一次 `beatra.music.generate`。保留返回的 `task_id`,通过 `beatra.tasks.get` 轮询同一任务;遵守返回的 `deadline_at`,未返回时主动轮询 30 分钟后停止并报告恢复方法,不要重新提交。仅用户要求时通过 `beatra.tasks.cancel` 取消。提交结果不确定或任务 ID 丢失时,用 `beatra.tasks.list` 加音乐能力搜索近期任务并逐一比对参数,只有参数完全相同的重试才能复用同一请求标识。参见 [任务与结果](references/tasks-and-results.md) 和 [计费、错误与恢复](references/billing-errors-and-recovery.md)。

### 步骤5:交付并审听音乐

任务成功后按返回顺序展示 `task.output.clips` 的每个条目,包含标题和歌词(如有)及 `clip.audio.url`、产物 ID、时长、MIME 类型和大小。报告真实任务标识与 `billing.net_charged_credits`。任务返回 `task.links.assets` 时使用该准确地址管理资产,不要编造通用网址。

只有宿主确实能播放音频时才审听作曲、歌词、人声表现、发音、角色分配、编曲、结尾和制作效果;否则明确说明尚未完成听感审查。保留成功的部分,把最大差距转化为一次聚焦且需重新批准的生成。遵循 [审听与迭代](references/review-and-iteration.md)。

## 按任务查阅资料

- 意图、歌词、纯音乐、多语言和参考音频路线:[意图与路线](references/intent-and-routing.md)
- 创作需求、风格、歌词写作、人声方向和语言:[创作需求与风格](references/creative-brief-and-style.md)、[歌词写作](references/lyrics-craft.md) 和 [人声、语言与标签](references/vocal-language-and-tags.md)
- 当前模型选择与准确参数控制:[模型路线](references/model-routing.md)
- 请求模式与聚焦的成品审听:[音乐方案](references/music-recipes.md) 和 [审听与迭代](references/review-and-iteration.md)
- 首次安装或授权过期:[安装与认证](references/installation-and-auth.md)
- 随包命令语法与排查:[随包 MCP Client 连接诊断](references/mcp-connection.md)
- 任务恢复、计费与返回结果:[任务与结果](references/tasks-and-results.md) 和 [计费、错误与恢复](references/billing-errors-and-recovery.md)

使用说明

# 音乐生成工作室

把主题、歌词或参考音频发展成完整的原创歌曲、纯音乐或 BGM,内置曲风简报、歌词写作、多语言演唱与模型参数控制方法论。

## 使用

对话中直接提出需求即可触发,例如:

- 「帮我写一首关于夏夜城市漫步的国语流行歌」
- 「把这段歌词做成一首能唱的歌」
- 「来一段 90 秒的咖啡馆 BGM,要能给旁白留空间」
- 「参考这段录音的旋律,改编成合成器流行风格」

技能会先给出制作卡(曲风、结构、人声方向、歌词),确认后生成可试听音频并按需聚焦修改。

首次使用需在技能目录运行一次 `python3 scripts/authorize.py` 完成浏览器授权;音频生成按所选模型实时计费。

## 工作原理

按请求类型(想法成歌/歌词成歌/纯音乐/参考驱动/多语种)路由到对应创作方法:先构建连贯的制作简报与可唱歌词,校验模型专属参数后经随包 MCP 客户端提交异步生成任务,交付音频产物与实际扣费,并提供听感审听清单与聚焦修改纪律。

如何安装此技能?

访问技能市场,点击「安装」按钮,按提示将技能包放入 AI 编程助手的 skills 目录即可。

浏览技能市场

支持平台:Qoder · QoderWork · Claude · Codex 等 AI 编程助手