| name | transcript-refiner |
| description | 将会议、演讲、课程的语音转写文字记录转化为专业精良的书面文稿。当用户提供原始语音转文字稿件,需要进行保真式���格(保留全部内容但提升表达品质)时,应使用此技能。适用于讲座整理、会议纪要、播客转录、访谈记录等场景。 |
| license | MIT |
文字记录精修器 (Transcript Refiner)
此技能提供将语音转写的原始文字记录转化为专业书面文稿的完整工作流程。
核心理念
绝对红线
- 忠实原意:增强表达,而非改变内容。严禁歪曲、增删演讲者的原始意图、核心观点、论证逻辑及关键信息。
- 杜绝简化:进行"保真式升格",将口语稿件完整、无损地转化为精良书面语,而不是提炼摘要。原文所有的论述层次、细节、案例、故事和情感铺垫都必须得到保留和优化。
- 逐行理解:一行行仔细理解原始文字记录内容,不跳过任何字词、段落。
四阶段工作流
阶段一:文稿诊断与策略制定
在开始编辑前,对文稿进行全面诊断,形成清晰的编辑策略。诊断围绕以下维度:
- **核心主张**:稿件的核心论点和关键信息是什么?
- **目标受众**:稿件的沟通对象是谁?他们的认知水平和需求是怎样的?
- **风格画像**:演讲者的语言风格是怎样的?
- 严谨学术型 / 生动风趣型 / 逻辑缜密型 / 娓娓道来型 / 批判激情型
- **情感温度**:演讲者在传递信息时附带了怎样的情感?
- 激情 / 冷静 / 关切 / 风趣 / 批判 / 传道热情
- **说服力来源**:论证逻辑、个人案例、数据支撑、权威引用、情感共鸣
此阶段的分析结果必须在最终《编辑摘要报告》中作为第一部分明确呈现。
阶段二:全面编辑与内容升格
基于阶段一的策略,对文稿进行深度处理:
2.1 语言精炼
**清除口语痕迹:**
- 系统性处理口头禅:嗯、啊、这个、那个、就是说、相当于是、然后说是
- 移除填充词和不必要的重复
- 清理表达累赘("的一个是"、"这一个是叫"等语音转写特征)
句式重构:
- 优化松散的口语结构,构建逻辑严谨、节奏多样的书面句式
- 恰当运用连接词,确保文气贯通
- 将过长的口语句拆分为多个清晰的书面句
2.2 勘误校验
**深度校正:**
- 结合上下文,修正所有错别字、标点
- 修正语音转写导致的"隐性"语义错误(同音字误用、断句错误)
事实核查:
- 核查所有专业术语、人名、地名、机构名、产品名
- 不确定处使用标记格式:
[存疑与核查建议:原文"XXX",根据上下文推测可能为"YYY"]
常见语音转写错误模式:
- 专有名词音译错误(如"安德烈卡巴西" → "安德烈·卡帕西")
- 数字与日期错误(如"2月30日" → 日期不存在,需核实)
- 公司/产品名称(如"班S" → 可能为"PingCode")
- 同音混淆(如"辩证方法论" → "边缘方法论")
2.3 结构优化
**段落梳理:**
- 基于语义内聚性,对段落进行智能切分、合并或重组
- 口语中的话题跳跃需重新组织为连贯的论述
层次呈现:
- 灵活运用多级标题、列表、编号,增强信息架构的层级感
- 对于长文稿(>5000字),主动构思章节结构
要点突出:
- 主动识别并以加粗方式突出核心定义、关键论断和重要结论
- 对比性信息考虑使用表格呈现
- 列举性信息使用有序/无序列表
构建标题:
- 原文较长时,主动添加能概括章节主旨、引导阅读的小标题
- 标题应反映内容实质,避免空泛
2.4 风格与情感保留
**保留个性:**
- 全力保留演讲者的独特语言风格
- 避免将其修改为千篇一律的"标准书面语"
- 保留演讲者的标志性表达和论证习惯
升华情感:
- 在书面语境下,巧妙再现和升华演讲者的情感温度与说服力
- 批判性语气、幽默感、热情等特质应在精修后依然可感知
2.5 疑难处理
**逻辑断裂/表述含糊:**
- 尽力结合上下文进行重构
- 若仍无法准确把握,标记为:
`[待确认:原文片段"(精确引述)",此处核心含义不明,建议复核]`
可删减内容(需记录):
- 确认属于口误
- 严重偏离主题的即兴内容(如调试设备、回应技术问题)
- 与上下文高度重复且无信息增益的内容
- 删减时必须使用格式记录:
[删减说明:原文片段"(引述)",理由:"…"]
阶段三:最终质检与自我审查
在交付成果前,对照以下清单进行最终检查:
- [ ] **内容完整性**:是否保留了原文所有的核心信息点和细节?
- [ ] **语言专业性**:是否已清除所有口语化、累赘的表达?
- [ ] **风格一致性**:润色后的文稿是否依然保有演讲者独特的风格与情感?
- [ ] **结构清晰性**:章节层次是否清晰,标题是否准确概括内容?
- [ ] **格式规范性**:最终交付成果是否符合阶段四的规范要求?
- [ ] **标注完整性**:所有存疑处是否已正确标注?
阶段四:最终交付成果规范
交付物一:精修版文稿
**形式**:独立的 Markdown 文件
**命名规则**:在原始文件名后添加"-精修版"后缀
- 示例:`我的演讲.md` → `我的演讲-精修版.md`
**存放位置**:与原始文稿存放在完全相同的目录下
**格式要求**:
- 使用规范的 Markdown 语法
- 合理使用标题层级(# ## ### ####)
- 适当使用加粗、列表、表格增强可读性
交付物二:编辑摘要报告
**形式**:直接在聊天对话框中输出(不生成单独文件)
**结构**:
【文稿诊断与编辑策略】
- 说明对该文稿的整体分析(呼应阶段一)
- 基于分析所采取的核心编辑策略
【重点修订说明】
- 以列表/表格形式,清晰列出3-5个最重要或最具代表性的修改
- 每项需包含"原文片段"与"修订后版本"的对比
- 阐述修改逻辑
【自我审视与待确认项】
- 提及润色过程中的挑战
- 明确列出所有
[待确认] 或 [存疑与核查建议] 标记的地方
- 列出所有
[删减说明] 的内容摘要
- 提醒用户复核
(若适用)【前后两次修改对比分析】
- 如果是对同一份文稿的第二次或后续优化
- 对比本次与上次修改的策略差异
特殊场景处理
场景一:提供了演讲大纲
若用户在同目录下提供了演讲大纲文件(如 PPT 导出、讲义提纲):
- 优先使用大纲作为章节结构的参考
- 大纲中的标题可直接作为精修版的章节标题
- 大纲有助于核实专有名词的正确写法
场景二:未提供大纲
若未提供大纲:
- 通读全文后,基于语义分析自动生成章节结构
- 识别明显的话题转换点作为章节分界
- 章节标题应概括该部分的核心主旨
场景三:超长文稿(>30000字)
对于超长文稿:
- 分批次处理,每批次约8000-10000字
- 确保批次之间的衔接自然
- 维护全局一致的风格和术语使用
- 最终合并时检查章节编号和交叉引用
场景四:多说话人记录
对于存在多个说话人的记录(如访谈、对话):
- 保留说话人标识(可优化格式,如
**主持人:**、**嘉宾A:**)
- 各说话人的风格应分别保留
- 对话的来回节奏应得到体现
输出示例
原文示例
说话人1 00:05:08
这种现象吧,就是说是在2025年吧,是特别的频繁,包括我自己也碰到好几次,晚上两点三点才会睡觉,他的他们就是说是为何工程师还有很多CEO都会沉迷的,现从我们心理学角度的心理学理论吧,也许可以给出一个比较好的答案。
精修后示例
这种现象在2025年特别频繁。包括我自己也碰到过好几次,晚上两三点才睡觉。
为什么工程师和CEO们会如此沉迷?从心理学角度来看,**心流理论**也许能给出一个较好的答案。
修订说明示例
| 原文片段 | 修订后版本 | 修改逻辑 |
|---|
| "这种现象吧,就是说是在2025年吧,是特别的频繁" | "这种现象在2025年特别频繁" | 去除口头禅(吧、就是说是),精简句式 |
| "他的他们就是说是为何工程师还有很多CEO都会沉迷的" | "为什么工程师和CEO们会如此沉迷?" | 修正语音转写错误,重构为清晰的问句 |
| "心理学角度的心理学理论" | "心理学角度" | 去除冗余重复 |
质量标准
**优秀精修稿的特征:**
1. 读者无法察觉这是从口语转写而来
2. 保留了演讲者的个人风格和情感温度
3. 结构清晰,可独立作为文章发布
4. 所有专业术语准确无误
5. 存疑处均有明确标注
常见错误避免:
- 过度精简导致信息丢失
- 风格统一化导致个性消失
- 遗漏语音转写的隐性错误
- 结构重组导致论证逻辑断裂
- 忘记标注不确定的内容