A
AI播客配音
作者:鹿Sir内容创作v1
把文章、公众号文章、笔记或定稿制作成自然流畅的单人播客口播与 MP3 单集音频:先整理成适合聆听的播客脚本,明确人名、术语和数字的读法,再选定主播音色、调整语速停顿,通过文字转语音生成音频。当用户需要文字转播客、文章转音频、制作播客单集或口播音频时触发。触发词:播客配音、文字转语音、文章转播客、口播音频。
下载量
362
点赞
89
价格
免费
技能文档
--- name: ai-podcast-voiceover title: AI播客配音 category: 内容创作 description: 把文章、公众号文章、笔记或定稿制作成自然流畅的单人播客口播与 MP3 单集音频:先整理成适合聆听的播客脚本,明确人名、术语和数字的读法,再选定主播音色、调整语速停顿,通过文字转语音生成音频。当用户需要文字转播客、文章转音频、制作播客单集或口播音频时触发。触发词:播客配音、文字转语音、文章转播客、口播音频。 --- # AI播客配音 作为单一固定主播的单集制作人工作:先了解节目档案,把用户提供的材料整理成便于聆听的脚本,确定主播和模型路径,用一段短试听验证方向,再制作并记录单集音频。 ## 适用范围与路由 本技能适合把用户提供的文章、笔记、大纲、新闻通讯或定稿,制作成单一主播的播客单集、预告、开场、收尾或按顺序交付的单集片段。节目会持续更新时,将主播方向、读音表和交付事实保留在一起。 有声书旁白、单条短视频口播、多语言配音、声音克隆等需求超出本技能范围时,交由用户环境中相应的音频技能处理;本技能只交付单主播单集音频,多主持混音、RSS 上架和专业母带不在交付范围内。用户要配乐时保留在本流程内处理。 ## 首次使用(授权) 合成音频为付费能力。首次使用或授权过期时,在本技能目录运行 `python3 scripts/authorize.py` 完成设备授权;详细流程与凭据安全约定见[安装与授权](references/installation-and-auth.md)。 ## 技能工作流 ### 步骤1:打开节目档案 硬性输入是节目与听众:给谁听,以及这一集要完成什么。先查找 `./<show>/show-profile.json`,档案已存在就复用;只有再次核验已确定的主播仍符合当前音色列表和模型路径时,才复用节目方向。对于新节目,在用户拥有的工作目录中确定预期听众、主播、语言、固定开场和收尾、读音表及交付约定。要配乐时,确认风格以及用户是否接受付费生成。详见[节目档案](references/show-profile.md)。 ### 步骤2:准备单集脚本 接受文章、笔记、大纲或最终脚本,整理为听众容易跟上的单集。以节目的预期听众为准;如果材料可服务于明显不同的听众目标,先询问希望听众带走什么,再起草。每一项事实、观点、数字和主张都以用户提供的材料为依据,不编造补位。按章节展示单集重点和口播草稿(含开场、收尾和读音表),在提出音频制作前等待批准。用户只需要脚本时,交付已批准的脚本即可。详见[单集脚本指引](references/episode-script.md)。 ### 步骤3:确定主播和模型路径 使用 `beatra.voices.list` 比较可用试听并确定一个不透明、状态就绪的 `voice_id`;合成时只提交该 ID,不使用显示名称。决定模型、语言或价格前,调用 `beatra.models.list` 并传入 `capability: "text_to_speech"`。用户明确指定模型时,它应当处于当前可用状态、与已确定的主播兼容并支持目标 BCP-47 语言。对 `auto`,只保留 `models.list.auto.candidate_order ∩ voice.compatible_models` 中当前可用的模型并保持目录顺序;该集合非空且每个成员都支持目标语言时才使用 `auto`。 除非节目档案或交付目的地需要受支持的其他设置,默认使用 `model: "auto"`、MP3、速度 1.0、音量 1.0、音高 0、不设置情绪和采样率。详见[声音、交付与恢复](references/voice-and-delivery.md)。 ### 步骤4:估价与确认 脚本准备、音色试听、当前模型查询和价格估算均不收费;每次 `beatra.speech.synthesize` 请求都需要付费。配音制作卡应列出准确文本、已确定的主播和设置、加权字符总数、实时价格计算、预计请求数量,以及每个逻辑请求对应的一个新的不透明 `client_request_id`。需要配乐时,配乐是独立的付费步骤,在整集配音获批后单独出示音乐床确认卡,绝不与配音卡合并。两笔付费都禁止自动重试;参数变了,就要新的 `client_request_id` 和新卡。 对第一集,或声音、语言、控制项发生变化后的单集,先制作一段结合开场和最具挑战段落的付费小试听(通常约 300 字符)。单集需要自身的批准;试听批准不包含单集,配乐批准也不等于配音批准。脚本超过 50,000 个字符时,按批准的主题或章节划分片段,并在制作卡中列出每一个付费调用。 ### 步骤5:制作、交付和记录 所有远程操作只能通过随包的 `scripts/mcp_client.py` 执行:工具名称作为 CLI 参数,JSON 参数通过标准输入传入。对每个已批准的逻辑付费请求,只用稳定请求标识提交一次,立即记录返回的任务 ID,并用 `beatra.tasks.get` 轮询至终态。 交付返回的单集音频及其真实 artifact ID、时长、MIME 类型、存在时的采样率、解析后的模型、用量和计费事实。生成过配乐时,单独交付那条素材,不要把单人 TTS 文件说成已混音的成集。宿主可以试听时,检查实际节奏、读音和主播契合度;否则明确说明仍需试听。获得用户批准后,可在节目工作目录追加已交付单集记录;否则把同一份事实记录和音频 URL 交给用户自己的节目台账。恢复路径详见[声音、交付与恢复](references/voice-and-delivery.md)。 ## 按任务选择参考资料 - 让已有文字更适合聆听、批准章节或记录读音:[单集脚本指引](references/episode-script.md) - 开始新节目、复用主播或记录已完成单集:[节目档案](references/show-profile.md) - 选声和模型、估价、提交音频、交付或恢复:[声音、交付与恢复](references/voice-and-delivery.md) - 首次安装或授权过期:[安装与授权](references/installation-and-auth.md) - 任务轮询、产物和结果字段:[任务与结果](references/tasks-and-results.md) - 余额、校验和结构化错误:[计费、错误与恢复](references/billing-errors-and-recovery.md) - 随包客户端无法连接时:[MCP 连接诊断](references/mcp-connection.md) - 移除本技能或共享凭据:[卸载与断开连接](references/uninstall-and-disconnect.md) ## 安全约定 - 凭据只保存在 `~/.beatra/credentials.json`,绝不进入对话、日志、命令参数或环境变量。 - 付费请求绝不自动重试;任何恢复动作先核对任务与请求标识。 - 只依据用户提供的材料写稿,不编造事实、数据或观点。
使用说明
# AI播客配音 把文章、笔记或定稿制作成自然流畅的单人播客口播与 MP3 单集音频,沉淀可持续复用的节目声音。 ## 使用 对助手说: ```text 把这篇文章做成一期单人播客节目 ``` 首次使用需在本目录完成一次设备授权(付费服务): ```bash python3 scripts/authorize.py ``` 远程操作统一通过随包客户端执行: ```bash python3 scripts/mcp_client.py verify python3 scripts/mcp_client.py tools python3 scripts/mcp_client.py call beatra.tasks.list ``` ## 工作原理 技能先把书稿整理成适合聆听的单集脚本(章节结构、开场收尾、读音表),经用户批准后选定主播音色与模型路径,出示包含价格与请求数的付费确认卡,再通过文字转语音接口合成音频并轮询任务至完成,最后交付音频与真实用量记录。节目档案(`show-profile.json`)沉淀听众定位、主播、读音表与单集台账,便于持续更新。 ## 依赖 - Python 3.10+(仅标准库) - 需要联网访问语音合成服务,合成按量计费 ## 安全约定 - 凭据仅保存在本机私有文件,不进入对话或日志 - 付费请求不自动重试,恢复动作先核对任务与请求标识
支持平台:Qoder · QoderWork · Claude · Codex 等 AI 编程助手