| name | knowledge-research |
| description | 调研技能,用于对代码仓库、书籍、概念等进行系统化调研,产出知识图谱文档(MD给AI看,HTML可视化给人看)。支持多轮迭代填充,用户引导式信息来源确认,动态调整细致程度。触发场景:用户说调研、研究、知识图谱、分析XX、学习XX、帮我了解XX。 |
Knowledge Research
Overview
系统化调研技能,产出双文档:
- MD文档:给AI看的结构化知识图谱(token效率优先)
- HTML可视化:给人看的可视化展示(样式精美)
核心流程:用户引导 → 产出知识框架 → 概念解释审查 → 多轮迭代填充
Workflow
用户触发调研请求
↓
第一步:确认研究对象和信息来源
↓
第二步:确认输出目录、调研详细程度和初步兴趣点
↓
第三步:评估调研复杂度,选择执行模式
├─ 单Agent模式(简单调研)
└─ 多Agent模式(复杂调研)
├─ 并行调研模式(大型仓库)
├─ 专业化模式(多维度分析)
└─ 上下文保护模式(内容量大)
↓
第四步:执行调研,产出知识框架(主体)
├─ 4.1 概念识别与解释
├─ 4.2 结构分析
└─ 4.4 概念解释审查(多轮迭代)
↓
第五步:生成文档
├─ 5.1 生成MD文档
├─ 5.2 生成HTML可视化
└─ 5.3 寓言解释增强(可选)
↓
第六步:多轮迭代循环
├─ 展示当前图谱
├─ 询问"想深入哪个部分?"
├─ 用户提问 → 判断落入哪一层 → 填充
└─ 更新MD和HTML,直到用户满意
Step 1: 确认研究对象和信息来源
1.1 确认研究对象
询问用户:
类型选项:
- 代码仓库:本地路径或GitHub URL
- 书籍/文档:书名、文档路径
- 概念/技术:概念名称
- 其他:用户自定义
1.2 确认信息来源
根据类型确认信息来源:
| 类型 | 信息来源确认 |
|---|
| 本地代码仓库 | 确认路径,不需要网络搜索 |
| GitHub仓库 | 确认URL,可能需要clone |
| 书籍/文档 | 确认是否需要网络搜索补充信息 |
| 概念/技术 | 确认是否需要网络搜索获取最新信息 |
关键:如果用户已提供完整信息(如本地路径),跳过此步。
Step 2: 确认输出目录、调研详细程度和兴趣点
2.1 确认输出目录
询问用户:
注意:如果用户在触发时已指定输出目录,跳过此步。
2.2 确认调研详细程度
询问用户想要什么等级的调研报告:
| 等级 | 描述 | 内容深度 | 适用场景 |
|---|
| 简略 | 快速概览 | 核心概念、主要结构、关键要点 | 快速了解、初步探索 |
| 适中 | 标准调研 | 详细结构、核心要素、基本关系 | 日常学习、项目了解 |
| 详细 | 深度分析 | 全面分析、多维关系、深入思考 | 深度研究、教学材料 |
询问示例:
- 你想要什么等级的调研报告?
- A) 简略:快速概览,了解核心概念和主要结构
- B) 适中:标准调研,包含详细结构和核心要素
- C) 详细:深度分析,全面分析并包含多维关系
注意:详细程度会影响后续调研的深度和广度。
2.3 确认初步兴趣点(可选)
询问用户:
- 你对哪些方面最感兴趣?
- 如果没有偏好,先产出整体知识框架
注意:兴趣点会影响第一轮调研的侧重点。
Step 3: 评估调研复杂度,选择执行模式
根据调研对象的特征,判断使用单Agent还是多Agent模式。
3.1 多Agent决策矩阵
| 条件 | 推荐模式 | 原因 |
|---|
| 大型仓库,有多个独立模块 | 并行调研模式 | 模块间独立,可并行提高效率 |
| 需要多维度深度分析(架构+流程+实现) | 专业化模式 | 不同维度需要不同专业视角 |
| 调研对象内容量 > 1000 tokens | 上下文保护模式 | 避免主Agent上下文污染 |
| 小型调研对象,内容量少 | 单Agent模式 | 多agent协调开销大于收益 |
| 顺序依赖强,后续依赖前面结果 | 单Agent模式 | 并行会降低质量 |
| 简单概念调研 | 单Agent模式 | 过度设计 |
3.2 并行调研模式
适用场景:大型代码仓库,有多个相对独立的模块
执行流程:
主Agent:分析仓库结构,识别独立模块
↓
分派多个SubAgent并行调研:
├── SubAgent1:调研backend模块
├── SubAgent2:调研frontend模块
├── SubAgent3:调研tools/utils模块
└── SubAgent4:调研配置和部署
↓
主Agent:汇总各SubAgent结果
↓
生成统一的知识框架
SubAgent职责:
- 分析指定模块的目录结构和关键文件
- 识别模块的核心功能和职责
- 识别模块的依赖关系和接口
- 返回结构化的调研结果
协调要点:
- 每个SubAgent只关注自己的模块,不交叉
- 主Agent负责汇总和去重
- SubAgent返回格式统一的摘要
3.3 专业化模式
适用场景:需要从多个维度深入分析(如架构、工作流、消息机制)
执行流程:
主Agent:识别调研维度
↓
分派专业SubAgent:
├── SubAgent1(架构专家):分析系统架构和设计模式
├── SubAgent2(流程专家):分析工作流和消息流
├── SubAgent3(代码专家):分析核心代码实现
└── SubAgent4(搜索专家):网络搜索补充信息
↓
主Agent:整合各维度结果,形成完整图谱
SubAgent职责:
- 架构专家:分析分层架构、模块依赖、设计模式
- 流程专家:分析数据流、消息流、生命周期
- 代码专家:分析核心算法、关键实现、代码质量
- 搜索专家:搜索相关资料、对比分析、最新动态
协调要点:
- 每个SubAgent有明确的调研维度和输出格式
- 主Agent负责整合不同维度的结果
- 避免重复调研同一内容
3.4 上下文保护模式
适用场景:调研对象内容量大(> 1000 tokens),需要保护主Agent上下文
执行流程:
主Agent:判断调研对象大小
↓
如果内容量大:
分派SubAgent处理具体内容
SubAgent返回摘要(50-100 tokens)
↓
主Agent:基于摘要生成知识框架
SubAgent职责:
- 读取和分析大量内容
- 提取关键信息,过滤噪音
- 返回精简的摘要
协调要点:
- SubAgent只返回主Agent需要的信息
- 摘要要精简,控制在50-100 tokens
- 主Agent基于摘要推理,不读取原始内容
3.5 单Agent模式
适用场景:简单调研,内容量小,不需要多维度分析
执行流程:
主Agent:直接读取和分析调研对象
↓
产出知识框架
适用条件:
- 调研对象内容量 < 1000 tokens
- 不需要多维度深度分析
- 顺序依赖强,并行会降低质量
Step 4: 执行调研,产出知识框架
根据研究对象类型和选择的执行模式,分析并产出知识框架(主体)。
关键原则:先解释"是什么",再解释"怎么用"和"关系"。
4.1 代码仓库分析
4.1.1 概念识别与解释
在分析结构之前,先识别并解释所有核心概念:
必须解释的概念:
- 类/接口:是什么类型(类/接口/抽象类),职责是什么
- 关键变量/字段:数据类型,代表什么含义
- 关键方法/函数:做什么,输入输出是什么
- 关键机制:工作原理,为什么这样设计
解释格式:
### [类名/概念名]
**定义**:[是什么 - 类型、性质]
**职责**:[做什么 - 核心功能]
**关键字段**:
- `field1: Type` - [含义说明]
- `field2: Type` - [含义说明]
4.1.2 结构分析
读取项目结构,分析:
产出:
## 知识框架(主体)
### 1. 定位
- 属于什么领域/范畴
- 解决什么问题
- 核心价值是什么
### 2. 核心概念解释
{先解释所有核心概念 - 类、接口、关键变量的定义和含义}
### 3. 结构
| 模块/目录 | 职责 | 关键文件 |
|-----------|------|----------|
| module1 | 职责描述 | file1.py, file2.py |
### 4. 核心要素
{每个模块的核心要素,引用已解释的概念}
4.2 书籍/文档分析
4.2.1 关键词与关键句识别
在分析结构之前,先识别并解释:
必须解释的内容:
- 关键词:定义是什么,为什么重要
- 关键句:含义是什么,传达什么信息
- 核心概念:清晰定义,与其他概念的区别
解释格式:
### [关键词/概念]
**定义**:[清晰的定义]
**重要性**:[为什么重要]
**示例**:[具体例子帮助理解]
4.2.2 结构分析
读取目录或内容,分析:
产出:
## 知识框架(主体)
### 1. 定位
- 属于什么领域/范畴
- 解决什么问题
- 核心价值是什么
### 2. 核心概念解释
{先解释所有关键词、关键句、核心概念}
### 3. 结构
| 章节 | 主题 | 核心概念 |
|------|------|----------|
| 第1章 | 主题描述 | 概念1, 概念2 |
### 4. 核心要素
{每个章节的核心要素,引用已解释的概念}
4.3 概念/技术分析
通过搜索或已有知识,分析:
产出:
## 知识框架(主体)
### 1. 定位
- 属于什么领域/范畴
- 解决什么问题
- 核心价值是什么
### 2. 核心概念解释
{清晰定义每个概念,包括技术术语的解释}
### 3. 结构
| 概念 | 定义 | 关键特征 |
|------|------|----------|
| 概念1 | 定义描述 | 特征1, 特征2 |
### 4. 核心要素
{每个概念的核心要素}
4.4 概念解释审查(新增)
关键步骤:在生成知识框架后,必须进行概念解释审查。
4.4.1 派遣审查 SubAgent
使用 concept-explanation-review.md 中的审查 prompt,派遣 SubAgent 审查知识框架。
SubAgent 任务:
- 检查所有概念是否有定义
- 检查定义是否包含"是什么"
- 标记缺失解释的地方
- 输出审查报告
4.4.2 多轮审查迭代
生成初版知识框架
↓
派遣审查 SubAgent
↓
审查通过?
├─ 是 → 进入 Step 5
└─ 否 → 根据审查报告补充概念解释
↓
重新生成知识框架
↓
再次派遣审查 SubAgent
↓
重复直到通过(最多 3 轮)
审查通过标准:
- 所有核心概念都有定义
- 定义包含"是什么",不只是"做什么"
- 技术术语都有解释
- 读者在没有原始内容的情况下能理解每个概念
如果 3 轮后仍未通过:
- 向用户说明情况
- 展示当前版本和审查报告
- 询问用户是否继续迭代或接受当前版本
Step 5: 生成文档
5.1 生成MD文档
按照 knowledge-graph-structure.md 的模板生成MD文档。
文件命名:{主题}-知识图谱.md
5.2 生成HTML可视化
使用 template.html 模板,按照 html-style-guide.md 的样式指南生成HTML。
文件命名:{主题}-知识图谱.html
关键:HTML必须包含Mermaid图表,可视化展示结构和关系。
5.3 寓言解释增强(可选)
目的:通过寓言故事让复杂的技术概念更易理解。
5.3.1 派遣寓言创作 SubAgent
在生成 MD 和 HTML 文档后,派遣寓言创作 SubAgent 审查知识图谱,识别适合用寓言解释的核心机制或概念。
使用 fable-creation-guide.md 中的寓言创作 prompt,派遣 SubAgent 创作寓言。
SubAgent 任务:
- 阅读完整的知识图谱文档
- 识别复杂的核心机制、流程或概念(如消息传递机制、状态管理、数据流等)
- 判断哪些部分适合用寓言解释(通常是抽象的、涉及多个组件交互的机制)
- 为每个识别出的机制创作一个寓言故事
- 输出寓言创作报告,包含所有寓言和插入建议
5.3.2 插入寓言到文档
SubAgent 创作完寓言后,将寓言插入到知识图谱文档的适当位置:
插入位置:
- 在相关机制的详细说明之后
- 作为独立的章节,标题为"[机制名称]寓言"
- 通常插入在"关系层"或"深度调研"章节中
插入方式:
- 更新 MD 文档:在相关章节后追加寓言内容
- 更新 HTML 文档:在相应位置插入寓言,使用特殊样式(如浅色背景框)区分
数量控制:
- 通常为 1-3 个寓言,覆盖最核心的机制
- 避免过多寓言导致文档冗长
- SubAgent 应优先选择最复杂、最难理解的机制进行寓言创作
Step 6: 多轮迭代
6.1 展示当前图谱
向用户展示当前知识图谱的概要:
6.2 询问下一步
询问用户:
6.3 内容归类
根据用户问题,判断落入哪一层:
| 问题类型 | 落入层次 | 示例问题 |
|---|
| "XX是什么?" | 知识框架 | "DeerFlow是什么?" |
| "XX的结构是什么?" | 知识框架 | "DeerFlow的架构是什么?" |
| "XX和YY有什么关系?" | 关系层 | "DeerFlow和LangGraph有什么关系?" |
| "XX怎么用?" | 思考层(应用视角) | "DeerFlow怎么用?" |
| "为什么这样设计?" | 思考层(设计视角) | "为什么DeerFlow这样设计?" |
| "深入讲讲XX" | 主题锚点 | "深入讲讲DeerFlow的消息机制" |
6.4 填充内容
根据归类结果,填充到相应层次:
6.5 迭代终止
当用户明确表示满意时结束:
- 用户说"就这些"、"可以了"
- 用户主动结束
- 用户不再提问
Resources
references/
- knowledge-graph-structure.md:知识图谱结构模板,包含MD文档结构和内容归类逻辑
- html-style-guide.md:HTML样式指南,包含设计风格、颜色方案、布局结构
- multi-agent-patterns.md:多Agent调研模式参考,包含决策流程、提示词模板和结果汇总模板
- research-depth-levels.md:调研详细程度参考,包含三级详细程度定义和选择指南
- concept-explanation-review.md:概念解释审查指南,包含审查 SubAgent prompt、审查标准、审查流程和示例
- fable-creation-guide.md:寓言创作指南,包含寓言创作 SubAgent prompt、创作原则、输出格式和示例
assets/
- template.html:HTML可视化模板,支持Mermaid图表和响应式设计