| name | deep_research |
| description | 对产品/公司/行业/概念/技术/人物进行系统性深度研究,产出结构化研究报告(Markdown + 可选 PDF)。 融合横纵分析法(时间深度+同期广度+交汇洞察)与行业研究实战范式(商业模式拆解+单位毛利归因)。 当用户说"深度研究"、"调研一下"、"竞品分析"、"行业研究"、"帮我摸清楚 XX"时使用。 不用于简单名词解释或公众号写作。完整触发词见正文。
|
| task_type | adhoc.deep_research |
深度研究 (deep_research)
触发词
深度研究、研究一下、帮我分析、做个研究、调研一下、竞品分析、行业研究、研究一个新行业、从零研究、横纵分析、帮我看看这个东西怎么样、这个产品/公司/行业是怎么回事、帮我摸清楚、帮我搞懂、帮我做个 deep research、行业分析、商业模式拆解
概述
对任意研究对象(产品 / 公司 / 行业 / 概念 / 技术 / 人物)进行系统性深度研究,产出一份结构化、有洞察、可交付的研究报告(Markdown 主体 + 可选 PDF)。
本 skill 融合两套互补的研究方法论:
- 横纵分析法(普适框架):纵向追时间深度(起源→演进→当下)+ 横向追同期广度(竞品/同类对比)+ 横纵交汇洞察(历史如何塑造当下竞争位置 + 未来推演)。适用于所有研究对象类型。
- 行业研究实战范式(针对商业/行业对象的强化工具箱):商业模式拆解(靠什么赚钱?赚什么钱?合理利润率?)→ 数据搜集(一手来源优先)→ 单位毛利范式归因(单位营收 - 单位成本 = 单位毛利,解释量增价跌/分化)→ 结构性分化解释(为什么 A 强 B 弱)。当研究对象是行业/公司/商业产品时,这套工具箱比纯叙事更锋利。
核心判断:研究对象是"商业实体"(行业/公司/商业产品)时,优先用行业研究实战范式做商业模式拆解,再用横纵框架组织叙事和对比;研究对象是"非商业实体"(概念/技术/人物)时,用横纵框架主导,行业范式作为可选补充。
前置条件
- 联网能力:本 skill 的质量完全取决于信息的丰富度和准确性,必须联网搜索,不能仅靠已有知识
- LLM 池:长报告(>1万字)建议用 powerful 层(GLM-5.2 / DeepSeek)分段生成,避免单次上下文溢出
- PDF 导出(可选):复用
office_pdf skill 的方法论(参考 .agents/skills/office_pdf/references/basic.md 用 reportlab 现场实现),无需本 skill 自带脚本
- 依赖检查:
uv run python -c "import reportlab, pypdf, pdfplumber"(仅生成 PDF 时需要)
研究对象类型与范式选择
| 研究对象类型 | 主范式 | 强化工具箱 | 侧重点 |
|---|
| 行业 | 横纵 + 行业范式 | 商业模式拆解 + 单位毛利归因 | 商业模式、竞争格局、结构性分化 |
| 公司 | 横纵 + 行业范式 | 商业模式拆解 + 财务拆解 | 创始团队、融资、战略转向、营收结构 |
| 商业产品 | 横纵 + 行业范式 | 单位经济模型 + 用户口碑 | 版本迭代、技术路线、定价、用户增长 |
| 概念/技术 | 横纵主导 | 学术溯源(arxiv)+ 争论演变 | 起源、流行、争论、相近概念区别 |
| 人物 | 横纵主导 | 职业轨迹 + 同领域对比 | 经历、关键决策、公开言论变化 |
当用户没说清类型时,从输入推断("机场行业"=行业,"Hermes Agent"=产品,"Transformer"=技术/概念)。
工作流(6 步)
第 1 步:明确研究对象
拿到用户输入后,确认以下信息。如果用户已经给得足够明确(如"帮我研究一下机场行业"),不追问,直接开始:
- 研究对象:具体名称
- 类型:行业 / 公司 / 产品 / 概念 / 技术 / 人物 / 其他
- 研究动机(可选):为什么要研究?最近发生了什么?
- 特别关注点(可选):有没有特别想深入的方向?
- 输出格式:Markdown only / Markdown + PDF(默认)
第 2 步:联网信息收集
质量铁律:宁可多搜,不要因为信息不够导致后面的分析浮于表面。
并行搜索策略
使用子 Agent(Task 工具)并行搜索提高效率:
- 子 Agent 1 — 纵向信息:起源、创始人/发起者背景、发展历程、关键事件、版本迭代、融资、战略转向、危机
- 子 Agent 2 — 横向信息:竞品识别、各竞品特点和用户口碑、行业对比评测、市场份额
- 子 Agent 3(复杂对象才需要):补充信息,如创始人深度背景、行业环境变化、用户社区讨论(GitHub issues、Reddit、Twitter/X、知乎等)
每个子 Agent 的 prompt 中必须包含联网指引:
你需要联网获取信息。使用 WebSearch 发现信息来源,找到具体 URL 后用 WebFetch 深入提取。
多次搜索、多个关键词组合,不要只搜一次就放弃。
一手来源优于二手来源:官方博客 > 权威媒体原创报道 > 转载/聚合。
学术类研究对象必查 arxiv:curl -s "https://export.arxiv.org/api/query?search_query=all:关键词&max_results=10",返回 XML 含标题/作者/摘要/PDF链接。
prompt 描述目标("获取""调研""了解"),不要用"搜索""爬取"。
信息来源优先级
一手来源优于二手来源,多个媒体引用同一个错误会造成循环印证假象:
| 信息类型 | 一手来源 |
|---|
| 产品更新/技术决策 | 官方博客、GitHub Release Notes、创始人推文 |
| 融资/商业数据 | 公司官方公告、SEC/工商文件、招股书 |
| 用户口碑 | GitHub Issues、Reddit、Twitter/X、知乎、行业论坛 |
| 行业分析 | 权威媒体原创报道(非转载)、券商深度研究报告 |
| 学术/技术原理 | arXiv 论文、Google Scholar、学术会议论文集 |
| 行业财务数据 | 行业协会/监管机构官方统计(如民航局)、上市公司年报/发债主体公开财务 |
信息充分性自检
搜索完成后检查:
- 纵向:能讲出一个完整的故事吗?有没有明显的信息断层?
- 横向:竞品列表完整吗?每个竞品的信息够做对比吗?
- 来源:关键事实有可靠来源支撑吗?有没有只靠单一来源就下判断的?
信息不够就再补搜,不要凑合。
第 3 步:纵向分析(Diachronic / 时间深度)
沿时间轴,完整还原研究对象从诞生到现在的发展全貌。这是报告的主体部分,篇幅最重。
内容要求:
- 起源追溯:诞生背景、技术/理念/需求来源、创始团队或核心推动者(他们之前做过什么,为什么是他们)、当时的行业环境、种子事件
- 诞生节点:明确的首次发布/成立/提出时间,最初的形态和定位,跟现在有什么不同
- 演进历程:按时间顺序梳理所有关键节点(重大版本更新、融资、团队变动、战略转型、技术架构变化、用户规模里程碑、重大合作/收购、公关危机)
- 决策逻辑:在每个关键节点还原"为什么选 A 而不是 B",当时面对的约束条件,哪些早期决策"锁定"了后来发展方向(路径依赖)
- 阶段划分:自然分为几个阶段(萌芽期、快速增长期、转型期等),每个阶段有核心特征和核心矛盾
篇幅:6000-15000 字。历史越长、节点越多的对象靠近上限。核心原则是把故事讲完整、讲透,宁可写长写细,不要蜻蜓点水。
第 4 步:横向分析(Synchronic / 同期广度)
以当前时间点为切面,将研究对象与同赛道的竞品/同类进行全面对比。
首先判断竞品情况
- 场景 A:无直接竞品 — 跳过逐一对比,改为分析:为什么没有竞品(品类太新/壁垒太高/市场太小)?未来最可能从哪个方向冒出竞争者?有没有间接替代方案?
- 场景 B:少量竞品(1-2 个) — 逐一深入对比
- 场景 C:竞品充分(3 个及以上) — 选取最具代表性的 3-5 个对比,其余简要提及
对比维度(按对象类型灵活调整)
- 核心差异对比:技术路线/核心方法论、产品形态/商业模式、目标用户/适用场景、核心优势与短板、定价/规模
- 用户视角:每个竞品的真实用户口碑(社区评价、使用体验中被提及最多的优点和槽点)、用户实际使用方式与官方定位的偏差。不要写成参数对照表的文字版,要讲清楚每个竞品「活成了什么样」
- 生态位分析:研究对象在赛道版图中占据什么位置?当前格局是百花齐放、两强争霸、还是一家独大?
- 趋势判断:研究对象在竞争格局中的走向,机会和风险
篇幅:3000-10000 字。场景 A 控制在 3000 字左右,场景 C 每个主要竞品至少 1500 字独立分析。
第 4.5 步(商业对象强化):商业模式拆解 + 单位毛利归因
仅当研究对象是行业/公司/商业产品时执行此步,并融入第 3、4 步的叙事中。这一步来自行业研究实战范式,是本 skill 相对纯横纵分析法的核心增量。
详见 references/industry_research_toolkit.md。核心动作:
- 商业模式拆解:这个行业/公司/产品靠什么赚钱?赚的是辛苦钱、技术钱、还是牌照钱?合理利润率是什么水平?什么因素会影响它赚钱?(把"商业模式"这个不接地气的词翻译成"靠什么赚钱")
- 收入结构拆解:把总收入拆成 2-N 个业务板块(如机场 = 航空性收入 + 非航空性收入),算清各板块占比和毛利率差异,找出真正赚钱的业务
- 单位毛利范式归因:单位毛利 = 单位营收 - 单位成本。用它解释"量增价跌"(客流恢复了但利润没恢复,因为单位营收下降了)和"结构性分化"(A 强 B 弱,因为 A 的单位营收高/单位成本低)
- 成本结构拆解:高固定成本 vs 高可变成本?规模效应强弱?这决定了行业的竞争本质
- 结构性分化解释:不同玩家表现的差异,最终都能追溯到单位营收(区位/客流量/定价权)或单位成本(规模/折旧/管理)的差异上
关键产出:一张"单位经济模型表"(研究对象 vs 主要竞品的单位营收/单位成本/单位毛利对比),这是商业对象研究最有洞察力的部分。
第 5 步:横纵交汇洞察
这是整篇报告的精华段。把纵向发展脉络和横向竞争格局结合起来,给出综合性的、新的判断。不要写成前面内容的缩写版。
需要回答的核心问题:
- 历史如何塑造了当下的竞争位置:纵向历程中的哪些决策和事件,决定了它今天在横向对比中的位置?
- 竞品的纵向对比:如果把主要竞品也放到时间线上看,它们的起源和演变路径有什么不同?这些不同如何导致了今天各自的特点?
- 优势/劣势的历史根源:今天的每个核心优势/劣势,能追溯到历史上的哪个节点或决策?当初的「好决策」有没有变成今天的包袱?
- 未来推演:基于纵向趋势和横向竞争格局,给出三个剧本——最可能的、最危险的、最乐观的,每个剧本要有逻辑支撑
篇幅:1500-3000 字。
第 6 步:生成报告
6.1 撰写 Markdown 稿件
将完整报告写为标准 Markdown,保存到 workspace/deep_research/{研究对象}_研究报告_{YYYYMMDD}.md。
写作风格(详见下方"写作风格"章节):研究报告的严谨 + 可读性,不是冷冰冰的咨询报告,也不是满篇口语的公众号文章。
6.2 报告结构模板
# {研究对象} 深度研究报告
> 研究时间:YYYY-MM-DD | 所属领域:... | 研究对象类型:行业/公司/产品/概念/技术/人物
## 一、一句话定义
[用一句话说清楚这个东西是什么]
## 二、纵向分析:从诞生到当下
[完整的纵向叙事,6000-15000字]
### 起源
### 诞生节点
### 演进历程(按阶段)
### 路径依赖分析
## 三、横向分析:竞争图谱
[横向对比分析,3000-10000字]
### 竞品场景判断(A/B/C)
### 主要竞品逐一分析
### 维度对比矩阵
### 竞争格局判断
## 四、商业模式拆解与单位毛利归因(仅商业对象)
[行业研究实战范式产出,融入或独立成章]
### 商业模式:靠什么赚钱
### 收入结构拆解
### 单位经济模型表
### 成本结构与规模效应
### 结构性分化解释
## 五、横纵交汇洞察
[交叉分析和未来推演,1500-3000字]
### 历史如何塑造当下
### 优势/劣势的历史根源
### 未来推演(最可能/最危险/最乐观)
## 六、信息来源
[所有引用的来源列表,标注 URL 和访问时间]
## 七、方法论说明
[1-2 句话说明本报告采用横纵分析法 + 行业研究实战范式]
6.3 生成 PDF(可选)
复用 office_pdf skill 的方法论,不要本 skill 自带 PDF 脚本(避免重复造轮子):
参考 .agents/skills/office_pdf/references/basic.md 用 reportlab 现场实现,脚本写到 temp/,输入 workspace/deep_research/{研究对象}_研究报告_{YYYYMMDD}.md,输出 workspace/deep_research/{研究对象}_研究报告_{YYYYMMDD}.pdf。
若 office_pdf skill 的默认 PDF 样式不满足研究报告需求(如需要封面页、特定配色),参考 references/pdf_report_style.md 的封面页模板,用 exec_python 调 reportlab 现场实现,脚本写到 temp/。
写作风格
从"卡兹克文风"借鉴的核心元素(适用于研究报告)
- 节奏感:句子时长时短,段落之间跳跃自然。一句话自成一段制造重量感可以用
- 叙事驱动,不是罗列驱动:纵向部分要有故事弧线,有起承转合。不要写成"2023年1月发布了A,2023年3月发布了B"这种流水账
- 知识是「聊着聊着顺手掏出来」的:在讲述过程中自然带出背景知识,不要"下面我来给大家科普一下"
- 敢下判断:鼓励给出观点和洞察,但每个观点必须有事实支撑。先摆事实,再给判断。是推测的明确标注
- 层层剥开的修辞:不直接讲结论,用"现象→表面解释→更深的追问→核心洞察"的方式展开
- 回环呼应:开头埋的钩子,在交汇洞察或结尾 callback 回来
从"行业研究实战范式"借鉴的核心元素
- 用接地气的词替换术语:把"商业模式"说成"靠什么赚钱",把"利润率"说成"这门生意赚多少",把"竞争要素"说成"凭什么它能赚到别人赚不到的"
- 数据先行,判断跟上:每个判断前先摆数据("2024年起旅客吞吐量已超过2019年水平,但国际航线占比仅7.7%,仍是20年最低"),再给结论
- 范式归因:用"单位毛利 = 单位营收 - 单位成本"这种简洁范式解释复杂现象,让读者跟着推理
- 诚实标注局限:研究停在案头工作就说停在案头,没和业内专家交流就说没交流,不装全知
克制的元素(适合公众号但不适合研究报告)
- 过强的口语化:偶尔点缀可以,密度要比公众号低很多。不要满篇"这玩意""不是哥们""太牛逼了"
- 去小标题化:1-3 万字的内容如果没有清晰的章节结构,读者会迷路。报告需要清晰的章节导航
- 固定尾部:不要加公众号的三连/星标尾部
绝对禁区(AI 味标记,无论什么文体都要避免)
- 套话:"首先...其次...最后"、"综上所述"、"值得注意的是"、"不难发现"
- 空洞形容词:"赋能"、"抓手"、"打造闭环"、"生态协同"
- 教科书开头:"在当今 AI 快速发展的时代"、"随着技术的不断进步"
- 高频踩雷词:"说白了"、"意味着什么?"、"这意味着"、"本质上"、"换句话说"、"不可否认"
- 空泛工具名:不说"AI 工具"、"某个模型",要说具体名字
- 编造场景:信息搜不到时诚实标注「该信息暂缺」,绝不编造
用人话写
避免咨询公司式的套话和空洞概括。用具体的细节和例子代替概括性陈述。比如不要写「该公司在这一阶段实现了快速增长」,而要写「从2024年中期的1000万美元ARR到2025年底的10亿美元,增长曲线几乎是垂直的」。
不同研究对象类型的适配
核心原则不变(纵向追时间深度,横向追同期广度),但侧重点不同:
- 研究行业时:横纵 + 行业范式全用。纵轴关注行业起源、政策演变、技术迭代、关键事件;横轴关注子赛道格局、主要玩家对比;必做商业模式拆解 + 单位毛利归因(这是行业研究的精华)
- 研究公司时:纵轴关注创始团队、融资历程、战略转向、组织变革、关键人事变动;横轴关注商业模式差异、市场份额、营收对比;做财务拆解(营收结构、毛利率、单位经济模型)
- 研究商业产品时:纵轴关注版本迭代、技术路线演变、用户增长曲线、关键产品决策;横轴关注功能对比、性能对比、用户体验、定价;做单位经济模型(CAC/LTV/留存)
- 研究概念时(技术范式、商业模式、文化现象):纵轴关注概念起源(谁提出、基于什么理论/需求)、如何流行、经历了哪些争论和演变;横轴关注与相近概念的区别、各自适用场景、不同阵营的论证。必查 arxiv
- 研究人物时:纵轴关注个人经历、职业轨迹、关键决策、成长曲线、公开言论变化;横轴关注与同领域其他人物的对比(做事方式、风格、成就、影响力、路线选择差异)
篇幅总览
| 部分 | 字数范围 | 说明 |
|---|
| 纵向分析 | 6,000 - 15,000 字 | 报告主体,不要蜻蜓点水 |
| 横向分析 | 3,000 - 10,000 字 | 视竞品数量调整 |
| 商业模式拆解(商业对象) | 2,000 - 5,000 字 | 融入或独立成章 |
| 横纵交汇 | 1,500 - 3,000 字 | 精华段,给出新判断 |
| 全文总计 | 10,000 - 30,000 字 | 不要怕长,深度和完整度是价值所在 |
用户明确要"简短版"或"快速了解"时,篇幅可压缩到 3000-5000 字,保留一句话定义 + 纵向精简版 + 横向要点 + 核心洞察。
质检清单
交付前自检:
与其他 skill 的关系
- office_pdf:本 skill 不自带 PDF 脚本,生成 PDF 时复用
office_pdf skill 的方法论(参考其 references/basic.md 用 reportlab 现场实现)
- web_archive:研究过程中遇到的关键网页(官方博客、深度报道)可用 web_archive 存档,避免链接失效
- mindforge:若研究对象有大量 PDF/文档资料,可先用 mindforge 转换并建索引,再用语义搜索辅助
- task_closure:长篇研究(>1 万字)跨会话中断时,用 wip_tracker 留档,恢复时读 wip_get
关键约束
- 必须联网:不能仅靠已有知识,研究报告的价值在于深度和完整度
- 诚实标注暂缺:信息搜不到时标注「该信息暂缺」,绝不编造
- 一手来源优先:避免多媒体引用同一错误造成的循环印证假象
- 商业对象必做商业模式拆解:这是行业研究实战范式的核心增量,纯横纵分析容易浮于叙事
- 不重复造 PDF 脚本:复用 office_pdf skill 的方法论,避免工具膨胀
- 长报告分段生成:>1 万字时用 LLM 池分段生成(纵向/横向/交汇各一段),避免单次上下文溢出
输出位置
- Markdown 报告:
workspace/deep_research/{研究对象}_研究报告_{YYYYMMDD}.md
- PDF 报告(可选):
workspace/deep_research/{研究对象}_研究报告_{YYYYMMDD}.pdf
- 中间数据(搜集的原始信息、单位经济模型表):
workspace/deep_research/raw/