| name | transcript-to-deep-minutes |
| description | 将会议/圆桌/访谈的录音转录文本(含说话人标签)转化为结构化深度纪要——按「判断 → 思维模型(mindset) → 实证案例」三层提炼,聚合核心议题,联网核证业界实践,多 agent 并行编排并验收。适用于话题分散、多人实时交互、传统时间线式 AI 纪要抓不住重点的对话(圆桌、闭门交流、嘉宾问答、podcast)。触发语:深度纪要、会议纪要总结平庸/没抓住重点、转录转纪要、圆桌整理、从转录中识别核心嘉宾并整理纪要。 |
录音转录 → 结构化深度纪要
把"AI 流水账纪要"升级为"让没到场的人真能学到东西"的深度笔记。核心方法论:每个话题提炼三层——判断(说了什么结论)→ 思维模型(为什么这么判断)→ 实证案例(什么经历支撑它);想法不值钱,实践后的"为什么成/为什么不成"才值钱。
适用判断
负向出口:单人汇报式会议(议程明确、行动项导向)用普通纪要即可,不要用本流程。
流程(六阶段)
阶段 0:说话人识别(必做,人工验收)
ASR 说话人标签不可信:常见多人被合并到同一标签、同一人被拆成多个标签。先运行 scripts/speaker_stats.py <转录.md> 获得字数分布、称呼-接答配对和混人嫌疑,再用证据法交叉确认(至少两类):
- 称呼-接答配对:先 grep 高频称呼词(老师/总/哥/英文名)确定大家怎么称呼嘉宾,再看每次"称呼+提问"的下一段由哪个标签接答——多次配对指向同一标签即锁定
- 发言量分布:按标签统计字数(不是段数),核心嘉宾通常断层第一
- 内容身份特征:只有该身份才说得出的内容(如"我们有 N 个团队""我们这种受监管机构")
标签噪音判定用矛盾检测法:同一标签下既出现嘉宾式身份陈述、又出现向嘉宾提问的内容,即为多人混合标签。
验收协议:输出考证结论(嘉宾=标签 X + 三类证据)与噪音报告后停下,呈报用户确认或修正后才进入阶段 1。这是全流程唯一阻塞点——跳过它,后续所有归属都可能系统性错误。结论确立后:全流程内容驱动、不信标签;除核心嘉宾与主持人外,参与者一律按内容线索角色化("一位做 X 的参与者")。
阶段 1:分段并行提取
按对话自然边界(轮次/主题切换/休息)切成 4-8 段,每段一个并行 agent 提取话题块。每块必含:话题名、时间戳、嘉宾判断(保留原话锐度,禁止磨平成"AI 很重要"式废话)、mindset(没有就留空,不硬编)、实证案例(谁讲的→发生了什么→为什么成/不成)、其他参与者视角、引语候选(贴原文+时间戳)。原则:宁碎勿漏;纯寒暄段跳过但必须扫过(真实案例中开场闲聊里藏着嘉宾背景)。
阶段 2:议题聚合(需要全量话题块,此处用 barrier)
把所有话题块聚合成 3-5 个核心议题——标准是"大家反复回到的争论点",不是话题罗列。由浅入深排序。自检:每个议题必须有至少一个非显而易见的点,没有就降级合并。
阶段 3:联网核证(每议题一个并行 agent)
搜索业界最佳实践/权威数据补充每个议题,硬性要求:每条带可点击出处;标注与会场观点的关系(支持/补充/矛盾——矛盾项最有价值,不许只找支持项);会场观点与外部补充在成稿中严格分区。禁止编造来源,搜不到就少写。
阶段 4:引语与案例提纯(与阶段 3 并行)
- 引语:从候选中精选 ≤5 条,标准 = 相关性 × 记忆度 × 真实出现过(保时间戳可回查),宁缺毋滥
- 案例:去重合并,筛掉"只是想法没实践"的条目,每条必含"为什么成/不成 + 带走什么"
阶段 5:合成 + Critic 验收
Writer 按目标结构成稿(见下),Critic 按六条标准逐项 1-5 打分,任一项 ≤2 或有 blocker 即打回修订一轮。六条标准与验收细则见 references/quality-standards.md。
成稿结构
标题 + 导读(怎么读这份纪要,150 字内)
一、讨论脉络 —— 按时间的话题块梳理(判断→mindset→案例引用),带时间戳
二、核心议题 —— 3-5 个,每个:会场共识与分歧→嘉宾判断与 mindset→【业界实践补充】(带出处)→综合方法论
三、实践案例参考 —— 独立成节:发生了什么/为什么成或不成/带走什么
四、待进一步探讨的问题 —— 当晚没聊透的,天然是下次活动选题库
注意:对外发布版不要设"金句/TOP N"独立章节(机构方反馈:会放大八卦心态),精选引语融入议题正文;内部学习版可以单列。
Agent Team 编排
用 Task 工具并行派发 subagent(同一条消息内发起多个 Task 调用即并行;有 Workflow 编排工具时也可用它):阶段 1 并行 N 个 Reader → barrier → 阶段 2 单 agent 聚类 → 阶段 3/4 并行 → 阶段 5 Writer+Critic 串行。完整的编排脚本骨架(含各阶段 prompt 模板与 JSON schema)见 references/orchestration.md。72k 字转录的参考成本:约 15 个 agent、20-25 分钟。
发布前
若纪要将对外发布或活动适用查塔姆宫规则,必须接着用 minutes-sensitive-scan 技能做敏感信息检查与脱敏,再发布。