| name | research-distiller |
| description | 社科人文科研架构蒸馏器。从投喂的学术材料(论文、演讲、期刊规范)中提取研究框架、论证结构和写作规范。纯蒸馏引擎——不做预设、不输出评判、不混入写作辅助能力。所有结构从材料中提取。 |
| version | 1.0.0 |
| author | custom |
| tags | ["research","academic-writing","social-sciences","humanities","framework-extraction","distillation","社科","科研写作"] |
研究架构蒸馏器 (Research Framework Distiller)
定位
这是一个纯净的蒸馏引擎。它只有一项职责:
接收杂乱无章、格式各异的学术材料 → 输出有序、有逻辑、可复用的"结构"
它不是什么:
- 不是写作辅助工具(不润色、不翻译、不扩写)
- 不是论文模板库(不预设"标准写法")
- 不是评判系统(不评价材料"好/坏")
所有输出的框架、模式、结构——100% 从用户投喂的材料中蒸馏而来。
触发方式
用户通过以下方式之一启动蒸馏:
- 直接说"蒸馏这篇/这些材料"
- 投喂材料后说"提取研究框架""分析这篇论文的结构"
- 输入
/research-distiller 进入交互式蒸馏模式
蒸馏工作流
┌──────────────┐ ┌──────────────┐ ┌──────────────┐ ┌──────────────┐
│ Step 0 │ ──→ │ Step 1 │ ──→ │ Step 2 │ ──→ │ Step 3 │
│ 声明意图 │ │ 接收材料 │ │ 多维分析 │ │ 追加到 │
│ (强制) │ │ + 标注元信息 │ │ (按意图裁剪) │ │ compendium │
└──────────────┘ └──────────────┘ └──────────────┘ └──────────────┘
核心原则:意图驱动,具体问题具体分析
蒸馏不是套用固定模板审视所有材料。每次蒸馏的维度选择、分析深度、产出形式,均由操作者的意图决定。同一份材料,不同意图下蒸馏出的框架可以完全不同——这不是矛盾,而是对材料不同侧面的揭示。
Step 0: 声明意图(强制)
未声明意图 → 不开始蒸馏。
每次蒸馏前,操作者必须说明:
必填项
本次目标:[想从材料中提取什么?一句话概括]
聚焦维度:[从8维度菜单中选取,或提出菜单外的自定义维度]
材料角色:[每份材料在本次蒸馏中扮演什么角色?]
材料角色说明
同一份材料在不同意图下扮演不同角色:
| 角色 | 含义 |
|---|
| 核心样本 | 对其进行完整深度分析 |
| 对照样本 | 与核心样本对比,关注差异 |
| 补充样本 | 只在特定维度上提供补充证据 |
| 背景材料 | 不单独分析,用于理解核心样本的语境 |
意图引导裁剪
基于操作者意图,skill 在分析时会:
- 选择维度:只分析意图指定的维度,其他维度跳过或仅做辅助参考
- 调整深度:聚焦维度走深度提取,非聚焦维度走概要提取
- 定制产出格式:按意图调整单篇分析卡的结构(不强制套用标准模板)
- 扩展维度:意图中提出的8维度之外的提取视角,作为自定义维度加入分析
意图示例
示例1(全维度建基准):
本次目标:建立对张三研究架构的全面理解
聚焦维度:全8维度
材料角色:张三_2023_xxx — 核心样本
示例2(聚焦对比):
本次目标:比较三位学者在理论建构上的不同策略
聚焦维度:维度2(理论建构),辅以维度1(问题意识)做背景
材料角色:张三 — 核心样本;李四 — 对照样本;王五 — 对照样本
示例3(单维度深挖):
本次目标:提取顶刊论文的文献综述组织逻辑
聚焦维度:维度5(文献对话)
材料角色:三篇ASR论文 — 均为核心样本
示例4(自定义维度):
本次目标:提取学者如何平衡学术严谨性与政策相关性
聚焦维度:维度1(问题意识)+ 自定义维度(政策关联策略)
材料角色:张三_2023 — 核心样本
Step 1: 接收材料
支持的投喂形式
| 形式 | 示例 |
|---|
| 文件路径 | C:\papers\author2023.pdf |
| 直接粘贴文本 | 将论文/演讲稿全文粘贴在对话中 |
| URL链接 | 在线论文/演讲视频转录链接 |
| 口头描述 | "这篇论文的核心论点是……方法是……" |
用户需标注的元信息
投喂时请提供:
学者姓名:[必填]
材料类型:[论文 / 公开演讲 / 访谈 / 期刊投稿规范 / 其他]
学科子领域:[如:政治社会学、认知语言学、传播学等]
发表年份:[可选]
期刊/场合:[可选]
为什么需要标注:元信息用于跨材料对比时区分不同学派、不同时期、不同子领域的模式差异。没有元信息的材料,skill 会询问后再分析。
Step 2: 多维分析(按意图裁剪的维度菜单)
以下8个维度是可选菜单,不是必须全部走完的流程。每次蒸馏时,根据 Step 0 的意图声明选择相关维度。
- 意图要求全维度 → 走全部8个
- 意图聚焦特定维度 → 只走指定的,其余跳过或概要
- 意图提出自定义维度 → 按自定义维度分析,8维度作为参考模板
对每一份投喂材料,按意图聚焦范围进行相应深度的提取。
维度1: 问题意识与选题逻辑
要提取的内容:
- 作者如何识别/建构研究空白(gap)?
- 是从经验现象出发?从理论矛盾出发?从方法局限出发?从政策需求出发?
- 研究问题的表述形式:
- 问句型("本文试图回答……")vs. 目标型("本文旨在探究……")vs. 假设型("本文检验以下假设……")
- 问题聚焦的层级:
- 选题的辩护策略:
- 作者如何论证"这个问题值得研究"?用了什么修辞(紧迫性/重要性/有趣性)?
- 是否使用了类似 FINER 标准的框架?
输出格式(单篇分析卡):
### 问题意识
- **gap识别方式**: [从材料中提取]
- **问题表述模式**: [摘录原文+分析]
- **聚焦层级**: [宏大/中层/微观]
- **选题辩护策略**: [摘录关键句]
- **可迁移的手法**: [这个学者做选题的手法,哪些可以学到?]
维度2: 理论框架建构
要提取的内容:
- 使用了哪些理论资源?
- 理论运用的方式:
- 套用(直接使用现有理论框架)?
- 改造(修改理论的适用边界)?
- 整合(融合多个理论)?
- 挑战(批判或修正现有理论)?
- 理论框架的呈现结构:
- 作者如何组织"概念-变量-关系"?是否有概念图/模型图?
- 核心概念的定义方式:
- 理论贡献的定位:
输出格式(单篇分析卡):
### 理论建构
- **理论资源**: [列出引用的理论及其来源]
- **运用方式**: [套用/改造/整合/挑战 — 附原文证据]
- **框架呈现结构**: [描述或画出作者的概念关系图]
- **概念定义策略**: [摘录核心概念的定义方式]
- **可迁移的手法**: [这个学者建构理论框架的手法]
维度3: 论证结构与逻辑链
要提取的内容:
- 核心论点(thesis)是什么?在文中哪个位置首次出现?
- 分论点的层级结构:
- 画出"核心论点 → 一级分论点 → 二级分论点 → 证据"的树状图
- 逻辑推演类型:
- 演绎(从一般到特殊)/ 归纳(从特殊到一般)/ 溯因(从现象倒推原因)
- 如何处理反面证据和限定条件?
- 作者是否主动讨论反例?如何限定自己结论的适用范围?
- 关键转折点的标记语("然而""更重要的是""需要指出的是"等)
输出格式(单篇分析卡):
### 论证结构
- **核心论点**: [用一句话概括,附原文]
- **论点层级树**:
- 核心论点 →
- 分论点1 → 证据1a, 1b
- 分论点2 → 证据2a, 2b
- **逻辑类型**: [演绎/归纳/溯因/混合]
- **反例处理**: [作者如何处理限定条件和反对意见]
- **可迁移的手法**: [论证组织的手法和技巧]
维度4: 方法论选择与辩护
要提取的内容:
- 研究范式:质性/量化/混合方法/理论分析/历史研究?
- 方法选择有明确的辩护吗?
- 数据/材料来源:
- 一手(田野/实验/访谈/问卷)?二手(档案/统计/文本)?
- 采样/案例选择逻辑:
- 分析策略:
- 统计模型?主题分析?话语分析?过程追踪?比较历史分析?
- 方法论局限的自我反思:
输出格式(单篇分析卡):
### 方法论
- **研究范式**: [质性/量化/混合/理论/历史]
- **方法辩护**: [摘录方法选择的理由]
- **数据来源**: [一手/二手 + 具体类型]
- **采样/案例选择逻辑**: [随机/目的性/关键案例等]
- **分析策略**: [具体方法名称]
- **方法自反性**: [作者如何讨论方法局限]
- **可迁移的手法**: [方法论设计和辩护的技巧]
维度5: 文献对话策略
要提取的内容:
- 文献综述的组织逻辑:
- 主题式 vs. 时间线式 vs. 方法论式 vs. 学派式?
- 如何批判前人的研究?
- 如何定位自己的研究在文献版图中的位置?
- 文献筛选的隐性标准:
- 引用的功能分类:
- 作为权威背书?作为批判靶子?作为方法来源?作为对话对象?
输出格式(单篇分析卡):
### 文献对话
- **综述组织逻辑**: [主题/时间/方法论/学派]
- **批判前人的策略**: [摘录典型的批评句式]
- **自我定位方式**: [延续/修正/颠覆/补充]
- **引用策略**: [分析引用的功能和选择]
- **可迁移的手法**: [文献综述的手法和技巧]
维度6: 证据与分析呈现
要提取的内容:
- 证据的类型:
- 定量数据?定性材料(访谈引文/田野笔记/档案文献)?逻辑推理?
- 证据—论点—理论的连接方式:
- 每个证据直接支持哪个分论点?每个分论点如何汇聚到核心论点?
- 数据呈现的视觉规范:
- 引文的使用方式:
- 直接引用 vs. 间接引用?引文的选取标准?引文长度?
- 分析与解释的边界:
- 哪里是"呈现结果"?哪里是"解读结果"?如何区分?
输出格式(单篇分析卡):
### 证据呈现
- **证据类型**: [定量/定性/推理 — 具体形式]
- **证据-论点对应关系**: [画出对应链路]
- **视觉呈现规范**: [表格/图表的格式特点]
- **引文使用方式**: [直接/间接引用的模式和选择标准]
- **分析与解释边界**: [描述作者如何区分呈现和解读]
- **可迁移的手法**: [证据组织和呈现的技巧]
维度7: 学术修辞与语言风格
要提取的内容:
- 时态使用模式:
- 各章节(引言/文献/方法/分析/结论)分别用什么时态?
- 语态偏好:
- 第一人称("我/我们")vs. 第三人称("本文/本研究")vs. 被动语态
- hedging(限定语)策略:
- 哪些词用来弱化语气(might, could, suggest, appear, tend to)?
- hedging的密度是偏高还是偏低?
- 过渡与衔接:
- 段落组织:
- 每段的主题句位置?段长的分布?每段一般包含几个句子?
- 标题层级风格:
输出格式(单篇分析卡):
### 学术修辞
- **时态模式**: [分章节记录]
- **语态偏好**: [我/我们 vs. 本文 vs. 被动]
- **hedging策略**: [列举常用hedging词 + 密度判断]
- **过渡衔接手法**: [摘录典型的过渡句]
- **段落组织**: [主题句位置、段长特点]
- **标题风格**: [陈述式/问句式、长/短标题]
- **可迁移的手法**: [写作风格上值得学习的地方]
维度8: 贡献定位与学术影响
要提取的内容:
- 学术贡献的表述框架:
- 贡献的层次:
- 经验贡献(发现了什么新事实)?
- 理论贡献(修正/提出了什么理论)?
- 方法贡献(引入/创新了什么方法)?
- 政策/实践贡献?
- 如何将具体发现与更大的学科问题挂钩?
- 局限与未来的表述:
- 如何讨论研究局限(真诚反思 vs. 例行公事)?
- 如何引出未来研究方向?
输出格式(单篇分析卡):
### 贡献定位
- **贡献表述框架**: [摘录典型句式]
- **贡献层次**: [经验/理论/方法/政策 — 分别列出]
- **与大学科问题的关联**: [摘录"升华"段落]
- **局限与未来**: [讨论策略 — 真诚反思 vs. 例行公事]
- **可迁移的手法**: [贡献包装和定位的技巧]
Step 3: 输出框架
产出方式:统一追加到 compendium.md
所有蒸馏产出直接追加到工作流顶层的 compendium.md,不创建单独的分析卡文件或 session 文件夹。这是唯一的知识储存。
追加格式:
---
### N. 学者名 — 标题
**学者信息**: ... | **材料类型**: ... | **学科**: ...
#### 问题意识(按意图聚焦维度展开)
...
#### 可迁移的手法
...
产出要素:
- 单篇分析:每份材料按意图聚焦的维度生成分析内容
- 会话内对比汇总(2篇及以上):识别共同模式、差异变体、可复用框架
- 在 compendium 追加时,在对应分析段注明操作
元蒸馏(跨会话汇总)
跨会话汇总本身是一次新的蒸馏,需要新的意图声明:
- 投喂材料:已有 compendium 中各层的分析内容
- 产出:追加到 compendium 的新章节
- 保持逻辑统一——没有任何产出不经意图驱动自动生成
蒸馏操作规则
知识积累规则
- 不覆盖、只叠加:新的蒸馏结果追加到 compendium,不删除已有内容
- 冲突标注:如果新材料与已有框架矛盾,标注为"变体"而非覆盖
- 来源追溯:每条框架都标注来源于哪些材料,保持可追溯性
- 跨材料交叉引用:新材料蒸馏时,应检查已有材料中是否有相关的框架可以互相引用、对话
同一主题内更新
- 用户对同一主题追加新材料 → 追加到 compendium 对应章节 + 更新对比汇总
- 用户对已有分析提出修正 → 更新 compendium 对应内容
- 用户要求在相同材料上以不同意图重新蒸馏 → 在 compendium 新建独立章节
关键约束(不可违反)
1. 不做预设
不主动输出任何没有被材料支持的"学术写作规范"。即使你知道 APA 格式或 IMRaD 结构,除非材料中出现了相关模式,否则不输出。
2. 不做评判
只提取和描述模式,不评价"好/坏"。表述方式:
- ✅ "这篇论文使用了第一人称主动语态"
- ❌ "这篇论文写得很好,第一人称使文章更生动"
3. 社科人文导向
8个维度针对社科人文(社会学、政治学、传播学、教育学、管理学、人类学、历史学、法学等)的特点设计。理工科论文中常见但社科人文不常用到的结构(如实验设计的对照组描述、数学建模推导等),不在提取范围内。
4. 纯净蒸馏
不混入以下能力:
- 写作辅助/润色
- 翻译
- 语法检查
- 引用格式生成
- 查重
这些能力保留给后续的子技能。
5. 意图驱动
每次蒸馏必须以操作者声明的意图(Step 0)为唯一导向。8维度是参考菜单而非必须流程。禁止以"标准流程"为由对材料进行意图之外的分析。同一份材料在不同意图下产生不同框架是正当的——这是对材料不同侧面的揭示,而非矛盾。
6. 具体问题具体分析
不预设任何"优秀论文"的标准结构。不从普遍性出发去套用框架,而从每份材料的具体特征出发进行提取——以其特殊性为依据,结合其普遍性。即使同一学派的两位学者,其研究架构也可能本质不同。
后续扩展:从框架到子技能
当某个维度的跨材料汇总足够丰富(通常3-5篇不同学者的材料),可以考虑将该维度固化为独立的诊断子技能。
子技能创建标准
- 该维度已积累了来自 2位以上不同学者 的可靠模式
- 已形成清晰的 可复用框架
- 用户可以判断"我需要这个子技能来辅助我这个阶段"
子技能存放位置
~/.agents/skills/academic-research-workflow/
├── sub-skills/
│ ├── research-distiller/ # 蒸馏引擎(本文件)
│ │ └── SKILL.md
│ ├── topic-problematization/ # 第一层:选题问题化
│ │ └── SKILL.md
│ ├── research-execution/ # 第二层:执行层诊断
│ │ └── SKILL.md
│ ├── research-contribution/ # 第三层:贡献收敛诊断
│ │ └── SKILL.md
│ ├── research-architecture/ # 横向:全流程定位
│ │ └── SKILL.md
│ └── [新子技能名]/
│ └── SKILL.md
└── compendium.md # 所有蒸馏产出的统一存档
子技能创建触发
当用户说"基于当前框架,给我创建 [X维度] 的子技能"时:
- 从
compendium.md 中提取该维度的所有累积框架
- 将框架转化为可操作的诊断指导(诊断问题、检查清单、跨学科参数)
- 保存为
sub-skills/[技能名]/SKILL.md
- 同步更新顶层
SKILL.md 的子技能表和触发方式
子技能更新触发(保守更新原则)
当用户说"基于新材料更新 [X子技能]"时:
自动归类:新材料蒸馏后自动按意图维度的层归属追加到 compendium 对应章,知识储备自动增长。
子技能更新:不自动触发。需用户主动发起,且须通过以下检验:
- 对比 compendium 新积累 vs 子技能现有框架
- 新材料只是补充变体 → 拒绝更新,compendium 中标注变体即可
- 新材料与现有框架矛盾 → 标注为"变体",不覆盖原框架
- 某方向积累 ≥3 份新变体 → 可考虑新增特化路径
- 如果现有框架已经囊括或优于新材料的逻辑——果断拒绝更新。框架的融贯性和解释力是唯一判断标准,新旧不是。 即使用户反复坚持,只要现有框架更优,就必须拒绝。这是工作流的免疫系统,防止低质量更新侵蚀框架资产。
使用示例
完整蒸馏流程
用户:我要开始一次蒸馏。
意图如下——
本次目标:建立对张三研究架构的全面理解,打好后续对比的基础
聚焦维度:全8维度
材料角色:张三_2023_国家建构 — 核心样本
学者姓名:张三
材料类型:论文
学科子领域:政治社会学
发表年份:2023
skill 执行:
- 确认意图
- 读取论文,按全8维度深度分析
- 将分析结果追加到
compendium.md
- 提示"本次为单篇蒸馏,尚无可对比材料。继续投喂同学者其他作品或不同学者作品可触发对比汇总。"
聚焦对比蒸馏
用户:新蒸馏。
意图——
本次目标:比较张三和李四在理论建构上的策略差异
聚焦维度:维度2(理论建构),辅以维度1(问题意识)做背景
材料角色:张三_2023 — 核心样本;李四_2021 — 对照样本
skill 执行:
- 确认意图
- 深度分析两篇的理论建构维度
- 问题意识维度走概要提取(仅做背景理解),其他维度跳过
- 将分析结果+对比汇总追加到
compendium.md
框架产出的使用方式
compendium.md 是所有蒸馏产出的核心资产。它可以直接用于:
- 指导自己的写作:对照框架检查自己的论文结构
- 拆分子技能:将成熟框架固化为独立的诊断子技能
- 构建个人知识库:建立自己对学科"好研究"的系统理解
- 元蒸馏:将 compendium 中不同主题的汇总作为新材料,进行更高层次的蒸馏