A
AI多语言配音
作者:鹿Sir内容创作v1
根据各语言口播稿制作 AI 配音和多语言旁白,适合出海视频、产品发布、海外营销、跨境电商视频、课程培训和短剧译制项目。先按市场和片段整理文案,再为每种语言选择合适声音,用代表片段试听读音、语气、节奏和时长,交付清晰可审听的音频。当用户提到 AI 配音、视频配音、多语言配音、旁白合成、视频翻译配音、语音本地化等时触发。
下载量
444
点赞
104
价格
免费
技能文档
--- name: ai-multilingual-dubbing title: AI多语言配音 description: 根据各语言口播稿制作 AI 配音和多语言旁白,适合出海视频、产品发布、海外营销、跨境电商视频、课程培训和短剧译制项目。先按市场和片段整理文案,再为每种语言选择合适声音,用代表片段试听读音、语气、节奏和时长,交付清晰可审听的音频。当用户提到 AI 配音、视频配音、多语言配音、旁白合成、视频翻译配音、语音本地化等时触发。 category: 内容创作 --- # AI多语言配音 根据用户提供或确认的脚本,为每个目标市场制作组织清晰的旁白音频。复用对话中已有的 信息、投放目的、目标语言、声音方向、片段边界和时长目标。沿最短路径先完成一个有代表性 的试制片段,再制作其余已确认的音频范围。 ## 技能工作流 ### 步骤1:从要朗读的脚本开始 构建一张 `segment × locale` 制作矩阵。每个单元格记录语言区域和 BCP-47 标签、已确认文案、 受保护术语、发音说明、声音、演绎方向、格式、时长目标和状态。使用场景、课程、章节、 广告或可发布消息等自然片段,绝不要在句子中间切分。 如果源内容只有视频或音频,使用宿主实际可用的能力获取转录文本,或者请用户提供文本。 在用户确认最终要朗读的内容之前,始终将转录文本视为草稿。语音操作接收的是文本,而非 源媒体。用户要求本地化时,在对话中协助起草目标语言文案,保留产品名称、声明、数字、 单位、URL 和行动号召,并取得内容确认。除非用户提供了相应事实,否则不要宣称文案经过 专业审核或目标语言母语者审核。 完整的准备与审核门槛参见[矩阵设计](references/matrix-design.md)和 [语言区域就绪度与质量](references/locale-readiness-and-quality.md)。 ### 步骤2:选择声音并制作有价值的试制片段 如果已接受声音的返回信息卡支持目标语言,就复用该声音。否则调用 `beatra.voices.list`, 根据语言和用户表达的偏好筛选,并从实时信息卡中推荐两到三个合适候选。使用已有试听 URL 进行免费试听;不要仅为选声而合成付费音频。 默认使用 `model: "auto"`、语速 `1.0`、直接交付选 `mp3`、不设置情绪,并保持音高、音量 和采样率不变。已知音频将进入后续编辑时,使用 `wav` 或 `flac`。只有用户询问当前模型或 费用、选择特定模型,或者语言兼容性需要实时确认时,才调用 `beatra.models.list` 并传入 `capability: "text_to_speech"`。每个语音请求都把已确认的单元格文案作为 `input`,把选定的 返回声音 ID 作为 `voice`,把该单元格的目标 BCP-47 标签作为 `language`。 对于包含多个单元格的发布范围,每种语言区域选择一个有代表性的高风险片段进行试制。 优先选择包含名称、数字、技术术语、优惠或行动号召的片段。对于对时长敏感的工作,记录 目标时长,将其与试制片段的返回时长比较,并在确认后对脚本或语速做最小且有效的调整。 把时长当作设计约束,不要承诺精确同步。 ### 步骤3:一次确认完整付费范围 规划、文案起草、声音发现和试听都不会使用付费语音操作。在调用任何 `beatra.speech.synthesize` 之前,用一张易读的矩阵展示完整付费范围:所有包含的试制或 正式制作单元格,以及每个单元格的语言区域、已确认文案、声音、格式、演绎方向和时长目标。 说明列出的每个单元格都会产生一次付费渲染。用户明确确认完整矩阵后,即授权每个所列 单元格执行一次;不要再要求第二次确认。变更或新增单元格属于新的付费工作,需要重新展示 范围并取得确认。 为每个已确认的语言区域/片段渲染创建一个稳定且不透明的 `client_request_id`。每个已确认 单元格只提交一次,保留其 `task_id`,并使用 `beatra.tasks.get` 轮询同一任务。任务返回 `deadline_at` 时必须遵守;未返回时,主动轮询 30 分钟后停止,报告当前任务状态并稍后恢复, 不要无限等待或创建替代任务。随包客户端自行处理缓存式、尽力而为且不计费的安装注册; 不要在这个创作工作流中增加手动注册步骤。 ### 步骤4:使用随包 MCP Client 每次远程 MCP 操作都只能使用本 Skill 随包提供的 `scripts/mcp_client.py`。将 MCP 工具名作为 CLI 参数传入,并通过 stdin 发送一个 JSON 对象。不要配置或调用宿主 Beatra Connector, 也不要使用 REST/OpenAPI 作为降级或回退方案。精确命令和排查方法参见 [随包 MCP Client 连接诊断](references/mcp-connection.md)。 ### 步骤5:恢复任务并交付音频 排队中或运行中的任务表示工作仍在进行,不能因此再次提交。如果响应状态不确定,但所有 生成参数完全相同,就使用同一个 `client_request_id` 重试。文本、声音、语言、模型、语速、 格式、音高、音量、采样率或情绪的任何变化都必须使用新的请求标识,并构成新的付费工作。 如果任务 ID 丢失,使用 `beatra.tasks.list` 并指定 `text_to_speech` capability,对每个可能的 候选调用 `beatra.tasks.get`,并将其完整的 `task.input`、最终解析模型和时间信息与已保存的 矩阵单元格逐项比较,再决定是否创建任何内容。仅凭列表中的条目不足以确认原始请求。 只有用户要求时才取消;如果 `beatra.tasks.cancel` 发生冲突,继续轮询同一任务。 任务成功后,按语言区域和片段分组交付实际的 `task.output.audio.url`、资产 ID、MIME 类型、 大小、响应返回的采样率,以及 `task.output.audio.duration_seconds`。同时提供真实任务标识和 计费结果。只有宿主确实能够播放音频时,才审核发音、语域、停顿、声音适配度、语速、语气 和时长;否则应说明试听审核尚未完成,并交付事实结果。需要修改时,在重新取得付费确认后 只重做受影响的单元格。保持已接受单元格不变,不要宣称已经完成翻译、字幕、口型同步、 音色保留、音视频编辑或精确时长匹配。 详细任务与验收路径参见[恢复与交付](references/recovery-and-delivery.md)。 ## 按任务查阅资料 - 矩阵、分段、选声、默认值与试制片段:[矩阵设计](references/matrix-design.md) - 语言区域文案就绪度与试听审核:[语言区域就绪度与质量](references/locale-readiness-and-quality.md) - 精确重试、取消、终态结果与交付:[恢复与交付](references/recovery-and-delivery.md) - 首次安装或授权过期:[安装与授权](references/installation-and-auth.md) - 随包 MCP Client 命令与诊断:[随包 MCP Client 连接诊断](references/mcp-connection.md) - 安装注册行为:[安装注册](references/installation-registration.md) - 任务查找与结果字段:[任务与结果](references/tasks-and-results.md) - 余额、提交状态不确定、计费与错误:[计费、错误与恢复](references/billing-errors-and-recovery.md)
使用说明
# AI多语言配音 根据各语言口播稿制作 AI 配音与多语言旁白,适用于出海视频、产品发布、海外营销、跨境电商、课程培训与短剧译制。 ## 功能 - 按市场 × 片段构建制作矩阵,逐格管理文案、声音与状态 - 每种语言推荐 2-3 个候选声音,代表片段免费试听后再付费合成 - 支持中英日等多语种,BCP-47 标签、受保护术语与发音说明 - 交付 mp3/wav/flac,按市场、语言和片段整理,方便后续剪辑 ## 快速开始 对助手说需求即可,例如: - 「把这份课程讲稿配成中文和英文两个版本」 - 「为出海产品视频配日语旁白,脚本如下:……」 ## 说明 - 试听免费,正式合成为付费操作,付费前一次性确认范围与费用 - 只接收文本输入;源视频/音频请先提供转录文本
支持平台:Qoder · QoderWork · Claude · Codex 等 AI 编程助手