录
录音转写结构化笔记
作者:鹿Sir办公效率v1
将培训、会议、研讨/论坛、访谈或工作演示类录音的转写文本整理成结构化笔记。当用户提供"录音转写""转写结果""会议记录""培训记录""讨论纪要"等文本,或要求"整理笔记""提炼要点""生成纪要""做培训笔记""录音整理""会议笔记"时,使用此技能。核心要求是绝对忠于原文、禁止脱离原文编造结论,根据内容类型(培训/会议/研讨/访谈/工作演示)自动选择恰当的输出结构,支持生成统一视觉风格的 Word 文档。
下载量
252
点赞
63
价格
免费
技能文档
--- name: recording-notes-analyst title: 录音转写结构化笔记 description: 将培训、会议、研讨/论坛、访谈或工作演示类录音的转写文本整理成结构化笔记。当用户提供"录音转写""转写结果""会议记录""培训记录""讨论纪要"等文本,或要求"整理笔记""提炼要点""生成纪要""做培训笔记""录音整理""会议笔记"时,使用此技能。核心要求是绝对忠于原文、禁止脱离原文编造结论,根据内容类型(培训/会议/研讨/访谈/工作演示)自动选择恰当的输出结构,支持生成统一视觉风格的 Word 文档。 category: 办公效率 --- # 录音转写笔记整理(Recording Notes Analyst) 将任意场景的录音转写文本(培训、会议、研讨、访谈、工作演示)整理成忠于原文、信息密度高、按内容类型恰当结构化的笔记。这是一套经过多次真实转写文本验证后提炼的方法论,核心矛盾始终是:**在"信息密度"与"绝不编造"之间,永远优先选择后者**。 ## 零、不可违反的核心原则 这些原则适用于所有内容类型,任何步骤都不能违反: 1. **省略优先于编造**:原文依据不足、转写片段无法重建原意时,标注【原文未明确说明】或直接省略,绝不为了"看起来完整"而编造内容、补充讲者没说过的观点、或用合理猜测填补空白后假装是事实。 2. **区分"明确表达"与"推测理解"**:明确表达用"讲师指出""会议决定""原文提到";推测性内容必须用"可能意味着""推测其意图是""可理解为",未经明确说明的内容不能写成确定结论。 3. **拒绝空洞总结**:禁止"提高效率""增强能力""赋能团队"等无信息密度的套话。必须具体到:提高什么效率、用什么方法、在什么场景、达到什么效果。 4. **不平均分配篇幅**:识别原文中反复强调、举例最多、耗时最长、明确说"重点""关键"的内容,这些应重点展开;次要内容一句话带过或省略。 5. **保留专业术语**,不过度通俗化;但口头禅、重复表达、与主题无关的闲聊一律清洗删除。 ## 一、整理前的三个判断(务必先做,再动笔) ### 判断 1:内容类型分类 通读全文(或至少前 20% 与若干中段),判断属于以下哪一类,并据此到 `references/templates.md` 选择对应模板。不要不分类型地套用同一套八段式模板——这是本框架早期版本最大的问题:训练场景的模板用在会议记录上会逼着你编造"案例"和"行动清单",用在研讨发言上会逼着你假装存在一个不存在的"标准答案"。 | 类型 | 识别特征 | 模板 | |---|---|---| | 培训/讲座 | 单一主讲人占比高(通常>80%),出现"课程""培训""政策解读"等词,其余发言多为确认性插话或提问 | 模板 A | | 会议/决策 | 多人参与讨论,出现决策性表态("我们决定""按这个方案定了""请XX负责""下周完成") | 模板 B | | 研讨/论坛 | 多人轮流发表观点,无人下达强制决策,多角度并存,可能存在分歧未调和 | 模板 C | | 访谈 | 明确的一问一答结构,有提问者和受访者两种角色 | 模板 D | | 工作记录/操作演示 | 边操作边讲解,包含软件演示、屏幕共享口播、工具操作步骤 | 模板 E | 如果一份转写混合了多种类型(例如先讲政策、后做软件演示),按主要内容选择主模板,次要部分作为模板内的一个章节处理,不必另起一套结构。 ### 判断 2:发言人角色分级 不要把所有"说话人2""说话人3"都当作无意义噪音,也不要把每一句插话都当作正式观点。按内容实质分级: - **主导发言人**:承载主要实质内容的发言人,是笔记的主要信息来源。 - **共同主讲人/共同演示者**:占比不是最高,但独立承载某个模块的实质内容(例如培训中第二位负责演示操作的同事)。这类发言必须与主导发言人同等重视,不能因为"说话人2"编号靠后就压缩或忽略其内容。 - **插话/确认者**:仅"是的""对""好的""谢谢"等填充性短句,不计入正式内容,整理时直接过滤。 - **决策参与者(会议场景特有)**:哪怕只说了一句话,但若包含决定性表态(同意/反对/拍板),该表态必须出现在结论或待办事项中,不能因为篇幅短而漏掉。 判断的实操方法:扫描每位发言人的发言总量和内容性质,凡是连续多句、包含数据/判断/方案的,归为主导或共同主讲;凡是单字单词、纯情绪反应、附和的,过滤为插话噪音。 ### 判断 3:转写质量分级与纠错策略 转写质量在不同文件间差异巨大——同一套规则不分场景执行,会在干净文本上显得啰嗦,在乱码文本上又会逼着你编造。按以下三级处理每一处疑似错误: | 级别 | 判断标准 | 处理方式 | |---|---|---| | **级别1:高置信度修正** | 基于强上下文(行业术语、专有名词、明显同音字)能确定唯一正确写法,例如石化行业培训中出现"计算机队伍建设",结合上下文判断应为"技能队伍建设" | 直接订正为正确表述,不需要逐处标注,但若该订正改变了关键数字或结论,应在文末统一说明已做最低限度修正 | | **级别2:中等置信度** | 能推断大致含义,但具体措辞、数字、人名无法确认 | 给出推测表述,并标注【此处转写可能有误】或【推测为……,转写有误】 | | **级别3:无法重建** | 内容支离破碎、上下文断裂、多个说话人交叉打断导致语义无法还原 | 直接省略该片段,不强行拼出一句"看起来合理"的话。省略不会被发现是错的;编造会 | **红线**:纠错可以填补"显然是同音字/识别错误"的空白,绝不能用纠错的名义填补"原文根本没讲清楚"的空白。如果你发现自己在"合理推测讲师想表达的意思",先确认这是不是已经越过了纠错的边界、变成了脱离原文的发挥——如果是,停下来,改为标注或省略。 ## 二、结构化提取规则(所有类型通用) ### 数据表格化 原文中任何可比较、可枚举的数据——不同层级的数字要求、不同阶段的时间表、不同选项的对比标准、不同单位的指标对比——无论原文是口述列举还是零散提及,整理时都应转换为表格,而不是写成一长串夹杂数字的句子或项目符号列表。这是验证最有效的改进点:表格比嵌套项目符号清晰得多,尤其是涉及"层级×数量""阶段×内容""单位×指标"这类二维对比关系的内容。 判断标准:如果脱稿向同事口头转述这段内容时,你会自然地说"我列一下"或画一个表格,那它就该是表格。 ### 引用规范 - 「」内的内容必须是可追溯到原文的表述,可用"……"表示省略口头禅或语气词,但不能添加原文未出现的字句。 - 不确定能否准确还原的片段不要用「」直接引用,改写为概括性陈述,并按上面的转写质量分级处理。 - 每个论点配 1-2 句原文依据即可,不要堆砌引用;引用的作用是证明"确有此说",不是替代分析。 ### 篇幅与压缩控制(应对超长转写) 转写文本过长(数万字、跨两三个小时)时: - 对"反复强调的内容""举例最多的内容""决策性内容""耗时最长的内容"做完整展开; - 对一次性提及、未被追问、与主线无关的内容压缩为一句话或直接省略; - 与主题无关的闲聊、网络热梗、私人玩笑、设备故障等口语噪音一律删除,不必逐处标注省略了什么; - 如果同一论点反复出现(常见于会议中来回讨论同一议题),合并整理一次,不要按时间顺序重复记录。 ## 三、按内容类型选择模板 详细的章节结构、每个章节要写什么、每个字段从原文哪里取——见 `references/templates.md`。先完成上面的判断1(内容类型),再去读对应模板那一节,不要一次性读完全部五个模板再开始写。 简要对照: - **模板 A(培训/讲座)**:课程目标→核心观点(含原文依据/解释/应用场景/注意事项)→方法论流程→讲师强调内容→案例→易错点→行动清单→核心结论 - **模板 B(会议/决策)**:会议基本信息→议题与讨论结论→决策事项汇总表→待办事项清单(任务/责任人/截止时间,原文未提及的字段必须标注,不能编一个责任人或日期出来凑数)→风险与遗留问题→后续安排→结论摘要 - **模板 C(研讨/论坛)**:主题背景→各方观点梳理→共识与分歧(明确区分,不强行调和分歧)→关键论据→开放性问题→结论与启示 - **模板 D(访谈)**:受访者背景→核心问答整理(按问题归类而非逐句照搬)→受访者重点观点→细节数据→总结启示 - **模板 E(工作记录/操作演示)**:工作目标→核心方法论→工具与场景对照表→演示案例还原(按演示顺序,不得添加演示中未出现的步骤)→操作易错点→行动清单→核心结论 ## 四、输出前自查清单 落笔前,对照检查: - [ ] 是否存在无原文依据的扩展或主观臆测? - [ ] 模糊或推测性内容是否被误写成了确定结论? - [ ] 是否遗漏了原文真正反复强调的重点? - [ ] 是否出现"提高效率""赋能"之类空洞套话? - [ ] 表格中是否有编造的数字、责任人、日期来"凑齐"格式?(尤其是模板B的待办事项——原文没说责任人就写【原文未明确】,不要指派一个人) - [ ] 引用的「」内容是否真的能在原文中找到对应? - [ ] 转写错误的处理是否按三级标准执行,而不是统一订正或统一标注? - [ ] 内容类型分类是否正确?如果是会议却套用了培训模板,结构会显得牵强。 全部确认无误后才输出。 ## 五、输出格式决策 1. **默认行为**:先在对话中直接给出结构化文本(Markdown 层级标题+表格),不强行使用 Word 式的过度排版。这通常已经满足需求。 2. **用户要求文件/文档**(说"用Word""生成WPS文档""导出""做成文件"等):使用 docx 技能规范创建 .docx 文件并保存到用户指定的输出目录;可以使用本技能 `scripts/build_notes_docx.js` 提供的统一视觉模板(封面页、彩色多级标题、表格配色、页眉页脚),通过准备一份结构化 JSON 内容文件并调用该脚本来生成,避免每次重新手写一整套排版代码。脚本的输入 JSON 结构和示例见 `assets/example_content.json`,调用方式见脚本文件顶部注释。 3. **一旦用户在本次对话中表达过"要文档"的偏好**,后续同一对话中的同类请求默认沿用文档输出,不必每次重新询问格式。 4. 如果同时整理多份转写文本,文件名应能区分内容主题,不要用通用名称(如"笔记1.docx")。 ## 六、参考文件 - `references/templates.md`:五种内容类型的详细输出结构模板,包含每个章节的取材规则和易错提示。 - `scripts/build_notes_docx.js`:可复用的 Word 文档生成脚本,内置统一视觉样式(封面、页眉页脚、配色、表格交替底色),输入结构化 JSON 即可输出 .docx,避免重复编写排版代码。 - `assets/example_content.json`:上述脚本的输入 JSON 示例,包含全部支持的区块类型(标题、段落、列表、表格、提示框等),可直接参照字段结构填充实际内容。
使用说明
# 录音转写结构化笔记 将培训、会议、研讨、访谈、工作演示等场景的录音转写文本,整理成忠于原文、信息密度高的结构化笔记。 ## 核心能力 - 自动识别内容类型(培训/会议/研讨/访谈/操作演示),匹配对应输出模板 - 严格忠于原文,不编造、不脑补,模糊内容标注而非猜测 - 数据自动表格化,支持超长转写智能压缩 - 可选生成统一视觉风格的 Word 文档(含封面、配色表格、页眉页脚) ## 最简用法 提供录音转写文本,直接说: ``` 帮我整理这份会议录音转写 ``` ``` 把这段培训录音整理成笔记 ``` 技能会自动判断内容类型,选择对应模板输出结构化笔记。 ## 输出格式 - 默认输出 Markdown 结构化文本 - 说"用 Word 导出"可生成 .docx 文档 ## 支持的内容类型 | 类型 | 适用场景 | |------|----------| | 培训/讲座 | 单一主讲人,政策解读、知识培训 | | 会议/决策 | 多人讨论,含决策或任务分配 | | 研讨/论坛 | 多人轮流发言,多角度并存 | | 访谈 | 一问一答结构 | | 工作演示 | 边操作边讲解,软件演示 | ## 参考资料 - 五种模板详细结构 → `references/templates.md` - Word 文档生成脚本 → `scripts/build_notes_docx.js` - JSON 输入示例 → `assets/example_content.json`
支持平台:Qoder · QoderWork · Claude · Codex 等 AI 编程助手