口
口播种草视频制作
作者:鹿Sir内容创作v1
只有一个选题,也能做出一条口播种草视频。按产品或主题选定脚本结构,写出钩子、中段和结尾引导,画面与口播分两栏分别写,再产出分镜静图、选定音色的口播音轨、可选纯音乐垫底,以及首帧动起来、配好整段口播的竖屏短片。适合小红书种草口播、达人推荐、带货口播文案与脚本、测评向短视频、服务与知识类讲解及新号起号日更,抖音、视频号、小红书、快手通用,无需拍摄出镜和素材。当用户提到口播视频、种草视频、带货口播、短视频脚本、无素材出片等时触发。
下载量
380
点赞
94
价格
免费
技能文档
---
name: oral-seeding-video-maker
title: 口播种草视频制作
description: 只有一个选题,也能做出一条口播种草视频。按产品或主题选定脚本结构,写出钩子、中段和结尾引导,画面与口播分两栏分别写,再产出分镜静图、选定音色的口播音轨、可选纯音乐垫底,以及首帧动起来、配好整段口播的竖屏短片。适合小红书种草口播、达人推荐、带货口播文案与脚本、测评向短视频、服务与知识类讲解及新号起号日更,抖音、视频号、小红书、快手通用,无需拍摄出镜和素材。当用户提到口播视频、种草视频、带货口播、短视频脚本、无素材出片等时触发。
category: 内容创作
---
# 口播种草视频制作
从一个选题开始,最后拿到一条口播推荐视频。什么都不用上传——不用产品图,不用拍摄素材,也不用录好的人声。
## 适用范围与相邻路线
这条路线是:一个主题、一种脚本结构、一份分镜表、生成好的分镜图,以及一条由首帧动起来的竖屏口播成片。当有人想用口播形式推荐某样东西、手上又还没有任何拍摄素材时,它就是合适的。
素材已经存在时,别的工作流更合适。已有一张产品图、要把它做成视频,属于产品视频工作流。脚本已经写好、只差一个声音,属于配音工作流。有一条参考片要拆解重做,属于拆片重制工作流。需要一个真人或数字人出现在画面里,属于数字人口播工作流。需要体验证据的效果宣称,缺证据时停在标注草稿。需要实拍剪辑的工作路由出去。本包已经具备静图、口播、可选配乐和开场动画,零素材短片留在这里做完。
## 输入与默认值
唯一的硬性输入是主题:要推荐的产品、服务或话题,一句话说清。缺了就问;除此之外一开始什么都不要问。
对话里已经说过的受众、目标、账号人设和发布平台,直接复用。这些没有时,从主题里自己定,并在确认里说明你定了什么,而不是回头去问。
默认使用 9:16 竖屏画布、12 秒目标时长、[脚本结构选择](references/script-patterns.md)中选定的脚本结构、一张首帧加上用户标记的其他分镜,以及一个贴合短视频社交内容的口播音色。除非用户提出,否则不加音乐。默认把前 3 秒写成钩子——让人继续看下去的理由——而不是先自报家门。
有两件事决定了后面的每一个判断。**成片默认 12 秒、最长 15 秒——这是本路线自己的上限,且必须落在所选实时模型卡支持的范围内**,并且其中只有首帧会被动画成视频——其他被标记的分镜以静帧交付,供用户自己剪辑使用。
说法按来源划分。这东西是什么、给谁用、怎么用,由你来写。价格、参数、成分、效果、时限、资质和优惠条件,都来自用户。这些缺失时,就绕开它们把这一段写出来;绝不要生造一个看起来合理的数字,因为最后要为它负责的是用户。
## 技能工作流
第 1 到 3 步不花钱。用户批准分镜表之前,不会发生任何付费调用。
1. **选定结构。** 读懂主题,从[脚本结构选择](references/script-patterns.md)的六种脚本结构里选一种。结构决定分几段、每段干什么。
2. **写出分镜表。** 口播结构是钩子 → 证据或体验 → 行动号召,每一段都带精确到秒的起止点,并且分成两个独立字段——画面上是什么,以及嘴里说什么。文案按[口播文案写法](references/spoken-lines.md)所述做筛查。如果前 3 秒没有承担钩子,先改这份仍免费的分镜表,再进入任何生成确认。
3. **展示分镜表并取得批准。** 后面整条流程都建立在它之上,而此刻修改它是免费的。
4. 把 `text_to_image`、`text_to_speech` 和 `image_to_video` 的实时卡片用 `beatra.models.list` 读出来——需要垫乐时再加上 `text_to_music`——并把每一条计划中的图像、语音、视频和音乐事实,对照相应的卡片逐条核对。
5. **确认准备工作。** 展示哪些分镜会出图、9:16 画布以及之后再改它的代价、从 `beatra.voices.list` 中选定的现成音色、是否包含垫乐、当前预估费用,以及每一次计划中的付费调用所用的稳定请求 ID。
6. 用 `beatra.images.generate` 生成分镜图,一张一次调用。用 `beatra.speech.synthesize` 合成口播,然后读取真实返回的时长、体积和 MIME 类型。只有在确认过之后,才用 `beatra.music.generate` 产出垫乐。
7. **展示真实产物。** 宿主能访问时,把分镜图显示出来、把口播放出来,并报告真实时长。把任务真正返回的事实,和宿主无法查看的媒体区分开。
8. **出示视频入场卡。** 展示路线 `image_to_video`、工具 `beatra.videos.animate`、批准的首帧、那条口播、以音频为准的时长(不小于真实口播时长的最小整数秒)、分辨率(若已设定)、当前实时预估价,并明确告知:600 积分的注册礼金通常不足以启动这条视频;再给出确切地址 `https://console.beatra.ai/topup` 和入门档 ¥29 / 11,000 积分。不要推荐 ¥198。规划、比较或一句「做成片吧」都不算批准;首帧或口播已批准也不等于批准了视频。在用户确认已充值、或确认余额足够这次预估之前,不要创建视频的 `client_request_id`,也不要提交。确认之后,用批准的首帧、那条口播、明确选定的模型,以及那个以音频为准的时长,调用一次 `beatra.videos.animate`。
9. 用 `beatra.tasks.get` 轮询这个任务直到终态,交付成片,并复核你确实能看到的部分。
视频模型要明确指定,不要交给 `auto`:这个能力上只有部分模型接受外部提供的口播音轨,不接受的那些会把它丢掉。
画布由首帧决定,所以画布定晚了,就意味着每一件付费产物都要重做一遍。
## 需要确认的决定
分两个阶段确认花钱:先是分镜图、口播和垫乐,连同它们每一次计价调用一起确认,然后是最终视频。视频那次确认要放在用户看过可访问的分镜图、听过口播之后,因为这次调用最贵。
同样要确认、而不能自行决定的还有:9:16 以外的画布、把目标时长顶到 15 秒上限、用户没有核实过的关于该主题的说法、加垫乐,以及任何在产物已批准之后的改动。每一个改掉的参数都是新的付费工作,需要新的请求标识和重新批准。
垫乐作为单独的音轨交付,由用户在自己的剪辑软件里铺到成片下面。它的长度是提示词里的编排方向而不是一个控制项,所以要报告返回的时长,并预期需要裁剪。确认它的时候把这两点都说清楚,让它的角色在付钱之前就是明确的。
## 执行
所有远程 Beatra 工具只通过本 Skill 随包的 `scripts/mcp_client.py` 调用,工具名作为命令行参数,参数以 JSON 从标准输入传入:
```text
printf '%s' '{"capability":"text_to_image"}' | python3 scripts/mcp_client.py call beatra.models.list
printf '%s' '{"capability":"text_to_speech"}' | python3 scripts/mcp_client.py call beatra.models.list
printf '%s' '{"capability":"image_to_video"}' | python3 scripts/mcp_client.py call beatra.models.list
printf '%s' '{"capability":"text_to_music"}' | python3 scripts/mcp_client.py call beatra.models.list
printf '%s' '{"language":"zh-CN"}' | python3 scripts/mcp_client.py call beatra.voices.list
```
不要配置或调用宿主 Beatra Connector,也不要使用 REST/OpenAPI 作为降级方案。每一个逻辑上的付费请求给一个稳定、不透明的 `client_request_id`,并且只提交一次。
## 交付与复核
交付选定的脚本结构、分镜表、每一张作为静帧交付的分镜图、口播音轨、垫乐及其返回时长、成片、每一个任务 ID、返回的 artifact 链接、解析后的模型、返回的尺寸与时长,以及 `billing.net_charged_credits`。只报告任务确实返回的事实。
宿主能查看或播放返回的媒体时,检查每一张分镜图是否对得上它所服务的那一段、口播是否存在且收尾干净、成片是否贴合画布。说明哪些媒体细节无法检查,而不是从任务元数据里把它们推断出来。
## 恢复
每一个任务 ID 都立刻记下来,并且只轮询那一个任务。`queued` 和 `running` 意味着等待。创建请求的响应丢失时,只用逐字节一致的冻结载荷、在同一个标识下重新提交;任务 ID 丢失时,按该能力列出任务,把候选项和你自己的台账逐一比对之后再重试。重做其中一张分镜图时,其他产物原样复用。遇到 `insufficient_balance` 时,原样转达返回的消息,把 `https://console.beatra.ai/topup` 保持逐字不变,并且只有在用户说自己已经充值之后,才用同一个冻结的 `client_request_id` 重试。
## 按任务查阅参考
- 在六种结构里选定、确定分几段、说清每段干什么:[脚本结构选择](references/script-patterns.md)
- 按长度预算写口播文案、说法的来源,以及文案筛查:[口播文案写法](references/spoken-lines.md)
- 确切载荷、每一次确认冻结了什么、轮询、重做某一个阶段、恢复与取消:[口播种草视频工作流](references/workflow.md)
- 首次安装或授权过期:[安装与认证](references/installation-and-auth.md)
- 非计费的安装包注册:[安装注册](references/installation-registration.md)
- 任务轮询、产物与结果字段:[任务与结果](references/tasks-and-results.md)
- 余额、校验与结构化错误:[计费、错误与恢复](references/billing-errors-and-recovery.md)
- 随包客户端连不上时:[随包 MCP Client 连接诊断](references/mcp-connection.md)使用说明
# 口播种草视频制作 一个选题就能出一条口播种草视频:先定脚本结构,写钩子与分镜表,确认后生成口播音轨、分镜静图与竖屏成片,全程无需拍摄、出镜或素材。 ## 功能 - 六种脚本结构自动选型,分镜表画面/口播两栏输出 - 分镜静图 + 选定音色口播音轨 + 可选纯音乐垫底 - 首帧动画成竖屏短片(9:16,12 秒目标,最长 15 秒) - 付费调用前逐项确认费用,未批准不扣费 ## 快速开始 对助手说需求即可,例如: - 「做一条种草口播视频,主题是 XXX 颈椎按摩仪」 - 「给这个产品写口播脚本并出片:XXX」 ## 说明 - 分镜表确认前完全免费;图像/语音/视频生成为付费操作 - 成片只有首帧会动起来,其余分镜以静帧交付,方便自行剪辑
支持平台:Qoder · QoderWork · Claude · Codex 等 AI 编程助手