| name | sk-info-assets |
| description | Use this skill when the user provides a 飞书豆 / 飞书妙记 voice-to-text transcript of any spoken content (meetings, interviews, courses, lectures, podcasts, conversations) and wants 信息资产 (information asset) notes. Triggers include "飞书豆", "飞书妙记", "妙记", "AI 录音豆", "智能会议纪要"; pasted transcripts with timestamps like [00:05:23] or "speaker 00:05:23"; uploaded .txt/.md/.docx exports; feishu.cn/minutes/ or larksuite.com/minutes/ links; or requests like "整理会议纪要", "提炼访谈精要", "整理课程笔记", "总结这场对话", "录音资产化". Produces 8-section notes via the five-information-asset framework (recap / business / content / tools / actions + dashboard + closing + relationship graph), with stable IDs, three-tag metadata (source/value/time), value decision tree, and cross-references. Auto-chunks long transcripts. Works for any speaker / scenario; optional specialization via glossary.md. Do NOT use for live audio without transcript, article summarization, or short chat snippets. |
信息资产笔记(基于飞书豆/飞书妙记)
核心心智:不分析逐字稿,分析里面的信息资产。
不关心"它讲了什么",关心"哪些信息值得留下来"。
适用场景(任何值得沉淀的录音):
- 🎯 会议纪要 — 周会、复盘会、决策会、Brainstorm
- 🎙️ 访谈 — 用户访谈、专家访谈、播客录制
- 📚 课程 / 讲座 — 线下课、付费课、培训、分享会
- 🎧 播客 / 演讲 — 长内容收听、TED 类演讲
- 💬 对话 / 1on1 — 重要对谈、咨询、辅导
把飞书豆/飞书妙记的录音转文字稿,提炼成五类信息资产结构化笔记:
- 这个内容讲了什么(高保真复盘 + 概念定义)
- 哪些对业务有启发(改产品/课/交付/私域)
- 哪些能变成内容素材(朋友圈/公众号/视频/直播的金句、案例、观点)
- 哪些能沉淀成方法和工具(SOP、提示词、Skill、Agent、知识库)
- 哪些应该变成行动或问题(马上做、要讨论、问大佬、只是存档)
每条资产强制带 稳定 ID + 三标签:[ID] [来源:讲者讲|我引申|他人问] [价值:高|中|低] [时间:HH:MM:SS],价值评级走三步决策树(详见 references/output_templates.md)。
本 Skill 默认为通用版——任何讲者、任何场景都能直接用。如果要为某位讲者(或某类场景,如"复盘会")做更精准的术语对齐和风格定制(可选),按 references/cloning_guide.md 创建一个 glossary.md 即可。
何时使用
启动条件(任一即可):
- 用户粘贴的文本含飞书豆/飞书妙记特征:
[00:05:23] 时间戳、发言人 00:05:23 形式的说话人时间戳、"妙记" / "飞书豆" / "AI 录音豆"等字样
- 用户上传
.txt / .md / .docx 文件,内容为口语化转录稿(会议、访谈、课程、播客均可)
- 用户给出飞书分享链接,域名含
feishu.cn/minutes/ 或 larksuite.com/minutes/
- 用户明确说:"整理会议纪要"、"提炼访谈精要"、"整理课程笔记"、"总结这场对话"、"录音资产化"、"信息资产笔记"
不要使用的场景:
- 仅有音频/视频文件而无转录稿——先告知用户需要先用飞书豆/妙记转录
- 用户只想要原文整理(去口水、加标点),没有结构化诉求——改用简单清理
- 普通文章 / 邮件 / 短消息——这些不是"录音转录",改用通用总结
- 极短对话(< 2 分钟,< 500 字)——8 节框架会显冗余,直接 3 句话总结即可
工作流(4 步)
步骤 1:获取并清理转录稿
按输入形态分支处理(详见 references/workflow.md 的"输入处理"小节):
| 输入形态 | 处理方式 |
|---|
| 粘贴的纯文本 / Markdown | 直接保存到 /tmp/transcript.txt |
上传的 .txt / .md | 直接读取 |
上传的 .docx | 调用 python-docx 提取纯文本 |
| 飞书分享链接 | 用 web_fetch 抓取;若返回登录页,告知用户需先在浏览器中导出文本再粘贴 |
清理:去除明显的 ASR 噪声(连续的"嗯"、"啊"、重复词),但保留时间戳——后续可作为引用锚点。
步骤 2:长度判定与分块
调用 scripts/chunk_transcript.py 自动判断处理策略:
python scripts/chunk_transcript.py /tmp/transcript.txt
返回 JSON,关键字段:
strategy: "single_pass"(<15000 字符) 或 "chunked"
chunks: 分块数组,每块约 8000 字符,在时间戳/段落处自然切分
判定阈值可在调用时调整:--threshold 20000 --target 6000(适合 Claude 上下文较紧的场景)。
步骤 3:逐块抽取要素(若 chunked)或一次性抽取(若 single_pass)
对每块内容,从中抽取以下原料(暂存,不直接成稿)。每条原料必须带上三标签(来源 / 价值 / 时间):
- 主题段 → 服务于资产 #1(高保真复盘)
- 核心观点 → 服务于资产 #2(业务启发)和 #3(内容观点)
- 概念术语 → 服务于资产 #1(概念释义)和 #4(知识库)
- 金句(讲者原话凝练) → 服务于资产 #3(内容素材-金句)
- 案例(起承转合的故事) → 服务于资产 #3(内容素材-案例)
- 方法/工具点子(SOP / prompt / 流程) → 服务于资产 #4(方法和工具)
- 动作建议(讲者明示要做的事) → 服务于资产 #5(行动)
- 待解疑问(没讲透 / 我半信半疑) → 服务于资产 #5(问大佬)和"下次再听清单"
抽取阶段就要强行区分"讲者讲的" vs "我引申的"——把这两种贴上不同的 [来源] 标签。混在一起后续没法分。
分块场景下,所有原料带上 chunk 编号和时间戳锚点,合并时去重(详见 references/workflow.md "原料抽取"小节)。
步骤 4:按五类信息资产模板输出
按 references/output_templates.md 的格式产出,固定 8 节顺序:
- 信息资产看板(1 屏数字概览)
- 这个内容讲了什么(高保真复盘 + 概念释义)
- 哪些对业务有启发
- 哪些能变成内容素材(金句 + 观点 + 案例 + 结构/比喻)
- 哪些能沉淀成方法和工具
- 哪些应该变成行动或问题(马上做 / 要讨论 / 问大佬 / 只是存档)
- 收束陈述(五连排比 + 一句话整体判断)
- 资产关系图(Mermaid)(交叉引用 ≥ 3 条时启用)
- (可选) 下次再听检查清单(值得二刷的课才加)
每条资产强制带 稳定 ID + 三标签:[ID] [来源] [价值] [时间],并按需挂交叉引用箭头(→ 配合 / ← 出自 / ↔ 关联)。
价值评级走三步决策树(在 output_templates.md 中详述):
- 下周内会让我做/改某事吗?是 → 进 Step 2;否 → 进 Step 3
- 能多次复用吗?是 → 高;否 → 中
- 推翻/大幅修正旧判断吗?是 → 中;否 → 低
校准锚点:全篇 [价值:高] 应 ≤ 30%,[价值:低] 应 ≥ 20%。
关键要求:
- 资产 #2(业务启发)的"录音原话"和"可迁移"必须分两栏写,不允许把'我引申'冒充'讲者讲'
- 资产 #3(内容素材)的金句必须保留讲者原话措辞
- 资产 #5(行动问题)的"马上做"必须有完成判据,且若依赖某工具必挂
→ 配合 A4-X
长度策略详解
| 字符数 | 估算 token | 策略 | 理由 |
|---|
| < 15,000 | < 7,500 | 单次处理 | 上下文充裕,一遍完成质量最高 |
| 15,000 – 60,000 | 7,500 – 30,000 | 分块抽取 + 合并 | 单次易丢细节,分块保留密度 |
| > 60,000 | > 30,000 | 分块 + 分主题合并 | 必须分块;合并阶段按主题聚合而非按时间 |
阈值仅供参考。如果用户明确说"我要尽可能详细"或"快速给我个概览",可上下浮动。
专属术语 glossary(可选)
通用版默认不含 glossary——任何讲者、任何场景都能直接处理。
如果你长期跟某位讲者(或某类场景,例如"季度复盘会"、"用户访谈"),可选地在本 Skill 目录下创建 glossary.md,把高频术语沉淀进来:
# 某讲者/某场景常用术语
## 贾维斯(Jarvis)
个人 AI 助手的统称,特指经过精心调教、能贴身工作的 Claude/GPT 实例。
## OKR 对齐
某团队复盘会高频出现的术语,意指 ……
抽取阶段遇到 glossary 中的词,在 Asset 1 的"概念释义"里优先采用 glossary 的定义,而不是自己即兴解释。
进阶:为某讲者 / 某场景做克隆版(可选)
如果你想给某位讲者(如某讲者)、某类场景(如"周会纪要")做触发更精准、风格更贴合的专属版本,按 references/cloning_guide.md 的步骤,把本目录复制并改造。常见情况:
- 你长期跟某位讲者(讲者 / 嘉宾 / 同事),想让 Claude 一看到关键词就自动用更贴合的风格
- 你有重复发生的场景(每周复盘会、用户访谈系列),想固化一份场景模板
- 团队需要稳定可分发的版本
但如果你只是偶尔整理一段录音,通用版完全够用——无需克隆。
参考文件索引
scripts/chunk_transcript.py — 长度检测与分块,带 CLI
references/output_templates.md — 8 节输出模板 + 三标签 + 价值评级决策树 + 交叉引用 + 资产关系图
references/workflow.md — 输入处理细节、链接抓取、合并策略、原料抽取规则
references/cloning_guide.md — 克隆为讲者/场景专属 Skill 的完整步骤
references/rendering.md — (可选) 把 Markdown 成稿渲染成何锦成风格 HTML 卡片
assets/render_template.html — (可选) HTML 渲染模板,11 个占位符