A

AI多语言配音

作者:鹿Sir内容创作v1

根据各语言口播稿制作 AI 配音和多语言旁白,适合出海视频、产品发布、海外营销、跨境电商视频、课程培训和短剧译制项目。先按市场和片段整理文案,再为每种语言选择合适声音,用代表片段试听读音、语气、节奏和时长,交付清晰可审听的音频。当用户提到 AI 配音、视频配音、多语言配音、旁白合成、视频翻译配音、语音本地化等时触发。

下载量
444
点赞
104
价格
免费

技能文档

---
name: ai-multilingual-dubbing
title: AI多语言配音
description: 根据各语言口播稿制作 AI 配音和多语言旁白,适合出海视频、产品发布、海外营销、跨境电商视频、课程培训和短剧译制项目。先按市场和片段整理文案,再为每种语言选择合适声音,用代表片段试听读音、语气、节奏和时长,交付清晰可审听的音频。当用户提到 AI 配音、视频配音、多语言配音、旁白合成、视频翻译配音、语音本地化等时触发。
category: 内容创作
---

# AI多语言配音

根据用户提供或确认的脚本,为每个目标市场制作组织清晰的旁白音频。复用对话中已有的
信息、投放目的、目标语言、声音方向、片段边界和时长目标。沿最短路径先完成一个有代表性
的试制片段,再制作其余已确认的音频范围。

## 技能工作流

### 步骤1:从要朗读的脚本开始

构建一张 `segment × locale` 制作矩阵。每个单元格记录语言区域和 BCP-47 标签、已确认文案、
受保护术语、发音说明、声音、演绎方向、格式、时长目标和状态。使用场景、课程、章节、
广告或可发布消息等自然片段,绝不要在句子中间切分。

如果源内容只有视频或音频,使用宿主实际可用的能力获取转录文本,或者请用户提供文本。
在用户确认最终要朗读的内容之前,始终将转录文本视为草稿。语音操作接收的是文本,而非
源媒体。用户要求本地化时,在对话中协助起草目标语言文案,保留产品名称、声明、数字、
单位、URL 和行动号召,并取得内容确认。除非用户提供了相应事实,否则不要宣称文案经过
专业审核或目标语言母语者审核。

完整的准备与审核门槛参见[矩阵设计](references/matrix-design.md)和
[语言区域就绪度与质量](references/locale-readiness-and-quality.md)。

### 步骤2:选择声音并制作有价值的试制片段

如果已接受声音的返回信息卡支持目标语言,就复用该声音。否则调用 `beatra.voices.list`,
根据语言和用户表达的偏好筛选,并从实时信息卡中推荐两到三个合适候选。使用已有试听 URL
进行免费试听;不要仅为选声而合成付费音频。

默认使用 `model: "auto"`、语速 `1.0`、直接交付选 `mp3`、不设置情绪,并保持音高、音量
和采样率不变。已知音频将进入后续编辑时,使用 `wav` 或 `flac`。只有用户询问当前模型或
费用、选择特定模型,或者语言兼容性需要实时确认时,才调用 `beatra.models.list` 并传入
`capability: "text_to_speech"`。每个语音请求都把已确认的单元格文案作为 `input`,把选定的
返回声音 ID 作为 `voice`,把该单元格的目标 BCP-47 标签作为 `language`。

对于包含多个单元格的发布范围,每种语言区域选择一个有代表性的高风险片段进行试制。
优先选择包含名称、数字、技术术语、优惠或行动号召的片段。对于对时长敏感的工作,记录
目标时长,将其与试制片段的返回时长比较,并在确认后对脚本或语速做最小且有效的调整。
把时长当作设计约束,不要承诺精确同步。

### 步骤3:一次确认完整付费范围

规划、文案起草、声音发现和试听都不会使用付费语音操作。在调用任何
`beatra.speech.synthesize` 之前,用一张易读的矩阵展示完整付费范围:所有包含的试制或
正式制作单元格,以及每个单元格的语言区域、已确认文案、声音、格式、演绎方向和时长目标。
说明列出的每个单元格都会产生一次付费渲染。用户明确确认完整矩阵后,即授权每个所列
单元格执行一次;不要再要求第二次确认。变更或新增单元格属于新的付费工作,需要重新展示
范围并取得确认。

为每个已确认的语言区域/片段渲染创建一个稳定且不透明的 `client_request_id`。每个已确认
单元格只提交一次,保留其 `task_id`,并使用 `beatra.tasks.get` 轮询同一任务。任务返回
`deadline_at` 时必须遵守;未返回时,主动轮询 30 分钟后停止,报告当前任务状态并稍后恢复,
不要无限等待或创建替代任务。随包客户端自行处理缓存式、尽力而为且不计费的安装注册;
不要在这个创作工作流中增加手动注册步骤。

### 步骤4:使用随包 MCP Client

每次远程 MCP 操作都只能使用本 Skill 随包提供的 `scripts/mcp_client.py`。将 MCP 工具名作为
CLI 参数传入,并通过 stdin 发送一个 JSON 对象。不要配置或调用宿主 Beatra Connector,
也不要使用 REST/OpenAPI 作为降级或回退方案。精确命令和排查方法参见
[随包 MCP Client 连接诊断](references/mcp-connection.md)。

### 步骤5:恢复任务并交付音频

排队中或运行中的任务表示工作仍在进行,不能因此再次提交。如果响应状态不确定,但所有
生成参数完全相同,就使用同一个 `client_request_id` 重试。文本、声音、语言、模型、语速、
格式、音高、音量、采样率或情绪的任何变化都必须使用新的请求标识,并构成新的付费工作。
如果任务 ID 丢失,使用 `beatra.tasks.list` 并指定 `text_to_speech` capability,对每个可能的
候选调用 `beatra.tasks.get`,并将其完整的 `task.input`、最终解析模型和时间信息与已保存的
矩阵单元格逐项比较,再决定是否创建任何内容。仅凭列表中的条目不足以确认原始请求。
只有用户要求时才取消;如果 `beatra.tasks.cancel` 发生冲突,继续轮询同一任务。

任务成功后,按语言区域和片段分组交付实际的 `task.output.audio.url`、资产 ID、MIME 类型、
大小、响应返回的采样率,以及 `task.output.audio.duration_seconds`。同时提供真实任务标识和
计费结果。只有宿主确实能够播放音频时,才审核发音、语域、停顿、声音适配度、语速、语气
和时长;否则应说明试听审核尚未完成,并交付事实结果。需要修改时,在重新取得付费确认后
只重做受影响的单元格。保持已接受单元格不变,不要宣称已经完成翻译、字幕、口型同步、
音色保留、音视频编辑或精确时长匹配。

详细任务与验收路径参见[恢复与交付](references/recovery-and-delivery.md)。

## 按任务查阅资料

- 矩阵、分段、选声、默认值与试制片段:[矩阵设计](references/matrix-design.md)
- 语言区域文案就绪度与试听审核:[语言区域就绪度与质量](references/locale-readiness-and-quality.md)
- 精确重试、取消、终态结果与交付:[恢复与交付](references/recovery-and-delivery.md)
- 首次安装或授权过期:[安装与授权](references/installation-and-auth.md)
- 随包 MCP Client 命令与诊断:[随包 MCP Client 连接诊断](references/mcp-connection.md)
- 安装注册行为:[安装注册](references/installation-registration.md)
- 任务查找与结果字段:[任务与结果](references/tasks-and-results.md)
- 余额、提交状态不确定、计费与错误:[计费、错误与恢复](references/billing-errors-and-recovery.md)

使用说明

# AI多语言配音

根据各语言口播稿制作 AI 配音与多语言旁白,适用于出海视频、产品发布、海外营销、跨境电商、课程培训与短剧译制。

## 功能

- 按市场 × 片段构建制作矩阵,逐格管理文案、声音与状态
- 每种语言推荐 2-3 个候选声音,代表片段免费试听后再付费合成
- 支持中英日等多语种,BCP-47 标签、受保护术语与发音说明
- 交付 mp3/wav/flac,按市场、语言和片段整理,方便后续剪辑

## 快速开始

对助手说需求即可,例如:
- 「把这份课程讲稿配成中文和英文两个版本」
- 「为出海产品视频配日语旁白,脚本如下:……」

## 说明

- 试听免费,正式合成为付费操作,付费前一次性确认范围与费用
- 只接收文本输入;源视频/音频请先提供转录文本

如何安装此技能?

访问技能市场,点击「安装」按钮,按提示将技能包放入 AI 编程助手的 skills 目录即可。

浏览技能市场

支持平台:Qoder · QoderWork · Claude · Codex 等 AI 编程助手