| name | systematic-review |
| description | Strict systematic review per Cochrane v6.5 + PRISMA 2020 + AMSTAR 2: PROSPERO/OSF protocol,
PRISMA-S search, dual-blind screening + Cohen's kappa, RoB 2 / ROBINS-I, GRADE, AMSTAR 2.
Use when user requests "systematic review", "系统综述", "系统性文献综述",
"循证综述(含 RoB/GRADE 等环节)", "PRISMA review", "Cochrane-style review". Trigger when
user explicitly requires PRISMA 2020 / Cochrane / RoB / GRADE / AMSTAR 2, OR submits to BMJ /
Lancet / Cochrane Library / Psych Bulletin. If user says only "循证综述" without
RoB/GRADE/PRISMA/Cochrane, main agent MUST ask whether PRISMA is required; do NOT auto-enter
12-stage — the term may mean integrative review (use field-overview-review). If user has a
literature set AND requires PRISMA, use this skill (skip L4-L5). Strict and learning modes.
Do NOT use for: scoping (field-overview-review), narrative without PRISMA (field-overview-
review/field-evolution-review), meta-analysis alone, theoretical reviews. Pair with
meta-analysis for pooling.
|
| license | PolyForm-Noncommercial-1.0.0 AND CC-BY-NC-SA-4.0 |
| metadata | {"author":"Bo","version":"1.1.1","consumes_ssot":"review-methodology-foundations"} |
Systematic Review
严格 PRISMA 2020 系统综述工作流。在 12 阶段生命周期中全面执行 Cochrane Handbook v6.5 标准,含 PRISMA-S 检索文档化、双盲筛选 + Cohen's κ、双人提取、按研究设计选用 RoB 工具、GRADE 证据等级、AMSTAR 2 自评。
1 你产出什么、不产出什么
1.1 路径 A 产出(严格模式 / 默认)
| 交付物 | 必含元素 |
|---|
| 主稿 | PRISMA 2020 27 条全对接(IMRaD 六大块) |
| PRISMA 流程图 | 4 阶段 + 每阶段排除数与理由 |
| PRISMA-S 文档 | 16 项检索可复现性 YAML |
| 协议声明 | PROSPERO/OSF 注册号;未注册需显式声明 + 时间戳 |
| 纳入排除标准表 | PICO 三层 + FINER |
| 筛选记录 | 双盲 κ + 仲裁记录 |
| 提取表 | SSOT-EXTRACTION-FIELDS 六大类 + 双人一致性 |
| RoB 评估表 | 按设计选 RoB 2 / ROBINS-I / QUADAS-2 / NOS / JBI(单被试用 SCED/RoBiNT,不是 SCRIBE) |
| 综合 | SWiM 9 项 + Popay 4 元素(不能元分析时) |
| GRADE 证据等级 | 5 降 + 3 升 + SoF 表 |
| AMSTAR 2 自评 | 16 项 7 关键域,置信度等级 |
| 写作过程档案 | SubAgent 分工 + 双盲披露 + 模式选择 |
| 决策档案 | decisions/01-11_*.md(应用 §3.3) |
1.2 路径 B 产出(学习模式 / 课程提案)
学习模式按 §9.2 简化项执行,但保留 L1+L2+L11 + PRISMA 流程图 三条硬约束。具体披露见 §9.3。
1.3 不产出(边界)
- 定量元分析(点估计合并、森林图、漏斗图、Egger 检验)→ 转
meta-analysis Skill 配套使用
- 范围综述(领域映射、概念地图,PRISMA-ScR)→ 转
field-overview-review
- 叙述综述(无双盲、无 PRISMA 流程图)→ 转
field-overview-review 或 field-evolution-review
- 理论建构综述(构念分析、对立理论比较)→ 转
theoretical-review
详见 §13 与其他 Skill 的关系。
1.4 标准交付物清单(独立小表,便于一眼对账)
主稿 / PRISMA 流程图 / PRISMA-S YAML / 协议声明 / PICO 三层表 / 双盲筛选记录 / 双人提取表 / RoB 评估表 / SWiM+Popay 综合 / GRADE+SoF 表 / AMSTAR 2 自评 / 写作过程档案 / 决策档案目录(共 13 类)。
2 触发与适用场景
2.1 应触发场景
正向触发的关键场景:
- 用户明确说"系统综述"、"systematic review"、"PRISMA review"、"Cochrane-style review"、"循证综述"
- 投稿目标是要求 PRISMA 2020 / Cochrane 标准的期刊(BMJ、Lancet、Cochrane Library、JCE、《心理学报》系统综述栏目)
- 用户描述含"双盲筛选"、"RoB 评估"、"GRADE 等级"、"AMSTAR 2"、"PROSPERO 注册"
- 学位论文方法学章节、博士资格审核、循证临床应用(指南制定、HTA 报告)
潜在触发场景(即使用户不说 PRISMA,也应推荐本 Skill):
- 用户明示需要 PRISMA / Cochrane / RoB / GRADE / AMSTAR 2 程序
- 用户提到"风险偏倚"、"证据等级"、"可复现的检索"
- 用户的研究问题是 PICO 形式(明确 Population/Intervention/Comparison/Outcome)
2.2 反向触发(Do NOT use)
| 用户场景 | 应转 Skill | 理由 |
|---|
| "探索某领域研究进展"、"做个文献综述了解领域"(无 PRISMA 关键词) | field-overview-review | 探索式综述,无双盲、无 RoB |
| "50 年研究发展史"、"领域演化" | field-evolution-review | 时间维度 + 5 维度检索 |
| "理论建构、构念分析" | theoretical-review | 论证为主、方法宽松 |
| "只做量化元分析",无质性合成需求 | meta-analysis | 直接进 L9 量化(如已有完整数据) |
2.3 模糊地带路由(消除 LS / SR 重叠 — W5-1 §1.3 题 14/15)
关键路由规则:
- 用户已提供文献集 + 要求 PRISMA / Cochrane → 用 systematic-review(本 Skill),跳过 L4-L5 检索;不用 literature-set-review
- 用户已提供文献集 + 要求"基于文献集写综述",无 PRISMA 要求 → 用
literature-set-review
- 用户没有现成文献集 + 要求 PRISMA → 用 systematic-review 完整 L1-L12
2.4 与 meta-analysis 的关系(联合工作流)
systematic-review 与 meta-analysis 是配套关系,不是替代关系:
- systematic-review 提供 L1-L8 + L11-L12 全部基础(PICO、检索、筛选、提取、RoB、报告、自评)
- 当数据可元分析时,L9 切换到 meta-analysis Skill 处理(详见 §4.2 L9 决策表)
- 联合工作流(切 MA):systematic-review 完成 L1-L8 → meta-analysis 完成 L9-L12(含 GRADE / APA MARS 报告 / AMSTAR 2,由 MA 产
10_grade_decision.md / 11_reporting_standard.md / L12_amstar2.md;锁4 §4.4 裁定:以元分析为终点的联合路径 MA 拥有 L9-L12)。纯 SR 路径(不切 MA)则由 SR 完成 L9-L12。
3 主 Agent 角色与责任
3.1 主 Agent 必读(启动即必读 —— G5:启动足迹从 ≈72k 三件套砍到 ≤10k digest)
主 Agent 在 Skill 触发后立即加载 review-methodology-foundations/references/LAUNCH-DIGEST.md(启动即必读,正文 ≤10k)——它蒸馏了原"启动即必读三件套"(SSOT-LIFECYCLE-12-PHASES + SSOT-METHODOLOGY-TERMINOLOGY + SSOT-AI-FAILURE-DEFENSES,≈72k)的全部载荷条款 + §1.2-18 前沿条款 + Cohen / k→限定语 / I² / GRADE / 学科×数据库 / 构念方向六张查表。读完这一份即掌握全流程载荷红线。
为什么改(G5):实战审计实测三件套 66-72k"启动即必读"被跳过 2/3——从未打开;被读率是主 Agent 派发 prompt 是否点名的函数,不是"必读"规定的函数。故三层修复:①启动只读 ≤10k digest(真读);②三件套 + 深层 SSOT 全文降级"按需下钻"(路径经 SSOT-INDEX.md 全库 resolver,见 §8);③关键载荷投放到 SubAgent 靠 PROMPT-COPY-BLOCKS.md 复制块(§6 · 内容进 prompt 的构造性保证),不靠自觉去读深文件。
SR 特定深层(不在启动加载,resolver 定位、按需下钻):SSOT-PRISMA-S-TEMPLATE(L5)/ SSOT-PRISMA-FLOW-DIAGRAM(L6 / L11)/ SSOT-MODE-PROFILES(L3)/ SSOT-AMSTAR-2-CHECKLIST(L12)——digest 给决策阈值,需完整模板 / 条目原文时按 resolver 路径下钻。关键载荷已在 digest / §6 复制块,SubAgent 不必自行去开深文件。
3.2 协调而非执行
主 Agent 在本 Skill 中是协调者,不直接调 MCP,不直接写综述章节。具体执行(检索、筛选、提取、写作、评估)全部外包给 SubAgent。
主 Agent 的核心动作:
- 理解:与用户对齐研究问题、综述类型、模式(严格/学习)、字数、语言、引用格式
- 规划:基于 SSOT-LIFECYCLE-12-PHASES 拆分阶段任务、识别依赖、决定串行 vs 并行
- 派发:写明确的 SubAgent prompt(含必读文件 + 任务 + 输出契约 + 自检)
- 审核:每阶段产出对照 PRISMA 2020 + AMSTAR 2 自检;发现问题派 Fix-Agent
- 整理:跨 SubAgent 文档落盘到工作目录,最终主 Agent 整合主稿
3.3 跨阶段决策档案规则(强制,应用 C1 模板)
主 Agent 在每阶段产出后,将决策性结论写入 decisions/ 子目录。这是 6 Skill 共享的工作流跨阶段决策档案机制,避免 L9/L11/L12 SubAgent 重新决策。SR 完整 11 类决策档案:01_type_decision.md(L1 类型 + 4 项判定矩阵)/ 02_research_question.md(L2 三层 PICO + FINER)/ 03_mode_decision.md(L3 严格 vs 学习)/ 04_search_strategy.md(L4)/ 05_search_execution.md(L5 PRISMA-S 16 项)/ 06_screening_dual.md(L6 κ + 仲裁)/ 07_data_types.md(L7 提取 ICC/κ)/ 08_rob_tool_decision.md(L8 RoB 工具,SCED/RoBiNT 而非 SCRIBE)/ 09_synthesis_decision.md(L9 含切换 MA 阈值)/ 10_grade_decision.md(L10)/ 11_reporting_standard.md(L11)。
每个决策档案使用统一 YAML frontmatter + 正文 + 上下游依赖 + 校验清单结构,完整模板见 references/decision-provenance.md。
L9/L11/L12 SubAgent 必读 decisions/:所有 L9/L11/L12 SubAgent prompt 必须显式列出 decisions/01-11_*.md(按阶段对应字段,参见 references/decision-provenance.md §3"消费者-生产者"映射)。不读决策档案直接执行 → 阻断;矛盾时主 Agent 仲裁。
追认①(G5 · 公理 8 好偏离追认)——规划文档=上下文容器:实战 SubAgent prompt 未逐档点名上列 decisions(01/03 普遍缺席),而由主 Agent 用"每轮专属规划文档"承载上下文(内嵌决策档指针),效果更优。规范承认此模式:上列决策档必读可由"读本轮规划文档(内嵌所需 decisions/*.md 指针)"等价满足;构造性底线 = §6 派发复制块把关键决策载荷直接写进 SubAgent prompt(填空题),不依赖 SubAgent 自觉去开 decisions 档。决策档案禁止自证式"[ ] 已读 <文件>"勾选(G5 · R3 实测 decisions/01 虚假"[x] 已读"已发生、transcript 零访问);"规定应读"改用模板 frontmatter required_readings 声明性机读字段,preflight --gate readings 一行 WARN 计数,差异表→v2。
L11 写作前主 Agent 二次验证:派发前主 Agent 验证当前 L11 SubAgent 计划的报告标准与 01_type_decision.md + 11_reporting_standard.md 一致(SR 必为 PRISMA 2020 27 项;心理学场景叠加 APA MARS)。不一致即阻断。
3.4 不允许的妥协
- 不允许在 systematic-review 中"压缩到 PRISMA 2 条"——这是 AMSTAR 2 Critical Domain 失败
- 不允许擅自降级英文检索代替中文检索(参见 §11.1 检索回退:主路径
paper-search-pro / 中文人工导出题录 → ingest_search_exports.py 摄入)
- 不允许把 SCRIBE 误用作单被试 RoB 工具(应用 SCED Scale / RoBiNT Scale,参见 SSOT-ROB-TOOL-MAPPING)
4 完整工作流(12 阶段对齐)
4.1 12 阶段总览表
每阶段对应一个或多个 references/ 文件。当前阶段加载对应文件即可,不需要前置加载全部。详见 §6 何时加载哪个 references 文件。
| L# | 阶段名 | 关键产物 | 主 SSOT | 主 references |
|---|
| L1 | 类型识别 + 4 项判定矩阵 | 类型确认 + 模式建议 + Skill 路由 | SSOT-REVIEW-TYPES | references/L1-question-construction.md |
| L2 | PICO 严格构造 | 三层 PICO + FINER + 假设三分 | SSOT-PICO-FRAMEWORKS | references/L1-question-construction.md |
| L3 | 协议预注册 | PROSPERO/OSF 注册号 / 状态声明 | SSOT-REPORTING-STANDARDS §1.2.2 | references/L2-protocol-registration.md |
| L4 | 检索策略 | 数据库列表 + 同义词 + 布尔 + PRESS | SSOT-SEARCH-STRATEGY | references/L4-search-protocol.md |
| L5 | 检索执行 | PRISMA-S 16 项 + 去重记录 | SSOT-PRISMA-S-TEMPLATE | references/L5-prisma-s-execution.md |
| L6 | 双盲筛选 | 一致性 + Cohen's κ + 仲裁 | SSOT-AI-FAILURE-DEFENSES §1 | references/L6-screening-dual-blind.md |
| L7 | 双人提取 | 结构化字段 + 一致性 + LLM 披露 | SSOT-EXTRACTION-FIELDS | references/L7-extraction-dual.md |
| L8 | 风险偏倚评估 | 按设计选工具 + 完整域评分 | SSOT-ROB-TOOL-MAPPING | references/L8-rob-assessment.md |
| L9 | 综合(Synthesis) | SWiM 9 项 / Popay 4 元素 / 切换 MA | SSOT-SYNTHESIS-METHODS | references/L9-synthesis-swim.md |
| L10 | GRADE 证据等级 | 5 降 + 3 升 + SoF 表 | SSOT-GRADE-FRAMEWORK | references/L10-grade.md |
| L11 | 写作 + 报告 | PRISMA 2020 27 条 + 流程图 + APA MARS | SSOT-REPORTING-STANDARDS | references/L11-prisma-reporting.md |
| L12 | 自评 | AMSTAR 2 16 项 + ROBIS | SSOT-AMSTAR-2-CHECKLIST | references/L12-amstar2-self-assessment.md |
4.2 各阶段任务详解
4.2.1 L1 类型识别 + 4 项判定矩阵(W5_FIX_PLAN E.P0.4 修缮)
systematic-review 的 4 项判定要素 + 判定矩阵(替代原"任一不满足则建议切换"的硬条件):
4 项判定要素:
- 用户的研究问题可形式化为 PICO(Population-Intervention-Comparison-Outcome)
- 用户接受双盲筛选 + RoB 评估 + GRADE 的工作量
- 数据可得性可支撑结构化提取(不仅是讨论级别概览)
- 用户接受 8,000+ 字综述长度(学习模式可降到 6,000-8,000)
判定矩阵(不再是"任一不满足切换"):
| 通过项数 | 决策 | 操作 |
|---|
| 4/4 | 严格模式 | 默认完整 12 阶段 + AMSTAR 2 ≥ Moderate 目标 |
| 3/4 | 严格模式 + 显式披露 | 完整 12 阶段,但在 Limitations 显式披露未满足项及其影响。例:项 1 失败(PICO 弱),披露"研究问题接近但不严格满足 PICO 形式,影响 Eligibility Criteria 边界" |
| 2/4 | 学习模式 + 强烈披露 | 切到学习模式(§9.2),所有简化点必须按 §9.3 披露原文模板写入。同时建议用户考虑切到 FO/LS |
| 1/4 | 切到 FO/LS | 不在 systematic-review 内做。主 Agent 显式向用户说明原因并推荐替代 Skill |
示例:
- 通过项 = {1, 2, 3}(4 失败:用户字数预算 4000)→ 3/4 → 严格模式 + 在 Discussion 显式披露"字数限制下,部分综合段落简化"
- 通过项 = {1, 3}(2/4:用户拒绝双盲 + 字数 5000)→ 学习模式 + 双盲降级披露 + 字数受限披露 + 询问是否切到 FO
判定结论写入 decisions/01_type_decision.md。
附加:FINER 5 项过滤(参见 references/L1-question-construction.md §3 + SSOT-PICO-FRAMEWORKS §5)。
4.2.2 L2 PICO 严格构造(Cochrane 三层)
systematic-review 强制三层 PICO(Cochrane v6.5 Ch.2 §2.3):
- Review PICO:综述层面的研究问题
- PICO for each synthesis:每个综合(如不同 Outcome 的 subgroup)的 PICO
- PICO of the included studies:每篇纳入研究实际的 PICO
三层间偏离必须在 Limitations 中显式报告。
4.2.3 L3 协议预注册(强制声明)
强制规则:即使未注册,也必须在主稿 Methods 节"Protocol and Registration"中显式声明(参见 references/L2-protocol-registration.md §1.1/1.2/1.3 三种模板)。
未声明协议状态属于 AMSTAR 2 项 2(Critical Domain 1)失败,自评最高 Low。
4.2.4 L4-L5 检索策略与执行(PRISMA-S)
systematic-review 严格模式必含:
- 4+ 学科核心数据库(如 MEDLINE / PsycINFO / EMBASE / CENTRAL)+ 灰色文献
- 引文追踪(forward + backward citation)
- PRESS 同行评审(推荐,Tier 2)
- PRISMA-S 16 项全部填写(YAML 模板)
- Bramer EndNote 6 步去重 + 记录每步去重数
学习模式可降级(≥ 2 库 + 简化布尔),但必须按 §9.3 披露原文模板显式披露简化点。
自动预筛(追认④,G5 · 公理 8):召回优先检索命中量大、噪音多(实战 ~80% 无构念词)时,双盲筛选前可加一步验证式自动预筛(构念关键词粗过滤,N_raw→N_prescreen)——但必须走三件套:种子 100% 保全 + 双重假阴抽验(0 假阴)+ Methods 显式披露,且不替代双盲(§4.2.5)与全文双人硬点。完整标准流程见 references/L6-screening-dual-blind.md §12。
检索执行外包(G6 · 外包交接包模式):L5 的检索执行(登录订阅库/粘贴检索式/逐库导出题录)是程序性外部劳动——主 session 不做,即使派 SubAgent 也不做(注意力经济)。L4 冻结签核后,主 session 生成检索请求包 search_request_pack/(request.yaml 机读 SSOT → render_search_pack.py 渲染 per_db/*.md 人读卡 + export_contract.md + hit_log_template.md),外包给可插拔执行器(人/Codex/另一 CC session/pending 检索 skill),回执经 scripts/validate_exports.py 硬门(复用 ingest 解析器 dry-run + 种子在场 + 命中一致性 + 无摘要披露 U-49;exit≠0 不摄入)验收后才交 ingest_search_exports.py。逐库导出陷阱见 references/db-quirks.md;模式规范见 review-methodology-foundations/references/OUTSOURCING-HANDOFF-PATTERN.md。契约边界:主 session 只产请求包 + 验收回执;"执行"是可插拔 executor 契约(入 request.yaml → 出 L5_export_<db>_<date>.<ext> + 命中记录 + executed_date 回写)。
4.2.5 L6 双盲筛选(关键 LLM 防御 — 10/10 范本所在)
LLM 实现的双盲:
- 派发 2 个独立筛选 SubAgent(不共享上下文,独立 prompt)
- 各自筛选同一份文献集合
- 主 Agent 比对两份决策清单 → 计算 Cohen's κ
- 不一致项进入第三个仲裁 SubAgent判定
- 全部决策记录写入
screening_log.csv
全文筛 = 双人硬点(U-16,2026-07-03 升硬点):标题/摘要筛与全文筛两层都必须双人独立——不是只有标题/摘要层双盲、全文层单人。实战教训:T/A 双盲花掉 16 SubAgent 后,全文层退化成单人筛(无 A/B、无全文层 κ),违反本规范且伤 AMSTAR 2 Item。故:全文合格性判定同样派 2 个独立 SubAgent + 仲裁 + 算全文层 κ(fulltext_kappa),落 L6_kappa_fulltext.json;SP2 签核门的 06a 以 fulltext_kappa_json 指针指向它(preflight additive 校验,缺则 WARN 起步——见 SUPERVISED-MODE-GATES §9.4)。Methods 披露须覆盖两层双人(若某层实际单人,诚实写单人、不得声称双人)。
显式披露要求(强制):在主稿 Methods 节明示"双盲筛选(标题/摘要 + 全文两层)由 2 个独立 LLM SubAgent 执行 + 1 个仲裁 SubAgent 处理不一致项;每个 SubAgent 不可见对方决策"。完整披露原文参见 references/L6-screening-dual-blind.md §6.1(W5-4 唯一 10/10 范本,复制即可用)。
Cohen's κ 阈值化决策(W5_FIX_PLAN E.P1.3):
| κ 值 | 决策 |
|---|
| κ ≥ 0.60(严格模式期望)/ ≥ 0.40(学习模式期望) | 仲裁不一致项即可 |
| 0.40 ≤ κ < 0.60 | 仲裁 + 重审 prompt(检查纳入排除标准歧义) |
| κ < 0.40 | 重做筛选(检查 SubAgent prompt 隔离失败 / 纳入排除标准歧义重大) |
4.2.6 L7 双人提取(含 LLM 实现披露)
全文获取+转换外包(G6 · 外包交接包模式):L6 纳入判定后、L7 提取前,纳入研究的全文下载 + PDF→Markdown 转换同属程序性外部劳动——主 session 不做。生成全文请求包 fulltext_request_pack/(下载清单 CSV + download_policy.yaml[Sci-Hub 预先点头 + 渠道白名单 + 依赖档位] + 自包含执行 Prompt)外包;执行器先 paper-downloader-portable 批量下(渠道白名单显式 + Sci-Hub 类需生成期预先点头 + 逐篇记实际渠道,治 U-08 不可追溯)→ 失败转手工逐库指引 → 接 document-to-markdown PDF→MD + 抽图 + 保页码锚点(derive_anchors.py 产 anchors.json)。回执格式契约见 meta-analysis/references/FULLTEXT-RECEIPT-FORMAT.md,经 scripts/validate_fulltext.py 硬门(文件在场/命名/转换完成/锚点可派生/MD 质量抽检:OCR 结构性掉行 + 元噪声,exit≠0 不摄入)验收。渠道纪律 = 公开边界红线上游执行面(G10 对齐)。
消费面(治 A-Q6 头号 token 浪费):提取 SubAgent 默认消费 MD + 按锚点回 PDF 关键页(p.N Table M 粒度);整本读 PDF 降为例外(仅锚点降级/关键数值歧义时)。关键数值/方向一律回 01_原始PDF/ 核对(MD 为 OCR),结论附页/表锚点——这是实战验证过的消费纪律。
systematic-review 严格模式:
- 派发 2 个独立提取 SubAgent
- 按 SSOT-EXTRACTION-FIELDS 六大类字段(R/P/I/C/O/M)+ X 类(编码者)
- 不一致项进入仲裁 + 报告 ICC(连续)/ Cohen's κ(分类)
LLM 双人提取披露原文(应用 C4 三段体例,复刻 L6 §6.1 范本):完整三段披露原文参见 references/L7-extraction-dual.md §"双人提取的诚实披露"。SubAgent 在 L11 写作时复制到 Methods 节"Data Collection Process"。
学习模式:单 SubAgent 提取 + 主 Agent 抽样 20% 复核(披露见 §9.3)。
4.2.7 L8 风险偏倚评估(按研究设计选工具)
按研究设计自动路由:
- RCT → RoB 2(5 域 + Cluster/Crossover 变体)
- 非随机干预研究 → ROBINS-I(7 域)
- 诊断准确性 → QUADAS-2
- 队列/横断 → NOS(Newcastle-Ottawa Scale)
- 质性研究 → CASP / JBI Qualitative
- 测量工具综述 → COSMIN
- 单被试设计 → SCED Scale 或 RoBiNT Scale(不是 SCRIBE — SCRIBE 是单被试报告指南,不是 RoB 工具,参见 SSOT-ROB-TOOL-MAPPING §11.2/§11.3)
主 Agent 按纳入研究类型批量分配,每篇研究按对应工具完整域评分。RoB 工具默认选择披露见 §10.3。
4.2.8 L9 综合(Synthesis) — 切换 MA 阈值决策表(W5_FIX_PLAN E.P0.5 修缮)
systematic-review 在 L9 默认走质性合成路径。切换 meta-analysis 决策表(替代原"k ≥ 5 且异质性可控"模糊表述):
| 数据条件 | 决策 | 路径 |
|---|
| k ≥ 5 + I² < 75% + τ² 估计有效 | 推荐切换 meta-analysis | systematic-review L1-L8 → meta-analysis L9-L12(切 MA 后 L10-L12 由 MA 完成,锁4 §4.4) |
| k ≥ 5 + I² ≥ 75% | 留 SR L9 SWiM/Popay | 不合并效应量;走 §11.4 异质性故障决策 |
| k ≥ 5 + I² > 90% | 完全禁止合并 + 强制 subgroup / meta-regression | 参见 §11.4 |
| k < 5(任意 I²) | 留 SR L9 SWiM/Popay | 元分析统计推断弱(Cochrane v6.5 Ch.10 §10.10.4) |
| 数据类型异质(连续 vs 二分)/ 测量工具不可转换 | 留 SR L9 SWiM/Popay | 不可元分析 |
| 质性证据综合 | 主题综合(Thomas-Harden 2008)/ 元民族志(Noblit-Hare 1988) | 走 GRADE-CERQual |
关键约束:禁止使用基于显著性的 vote counting(Cochrane v6.5 Ch.12 §6.5/6.6 — 不可接受方法)。
L9 综合方法决策写入 decisions/09_synthesis_decision.md。
4.2.9 L10 GRADE 证据等级
每个关键 Outcome 单独评 GRADE(Cochrane v6.5 Ch.14):
- 起始等级:RCT = High,NRSI = Low(ROBINS-I 启用时可豁免到 Moderate)
- 5 降级因素:RoB / Inconsistency / Indirectness / Imprecision / Publication Bias
- 3 升级因素:Large Effect / Dose-Response / Plausible Confounders Reduce
- 输出 Summary of Findings 表(GRADEpro 格式)
质性证据综合走 GRADE-CERQual(4 维度:Methodological Limitations / Coherence / Adequacy / Relevance)。
4.2.10 L11 写作 + 报告(PRISMA 2020 27 条)
主 Agent 整合各阶段产出,写主稿。结构对应 PRISMA 2020 27 条:
- Title (1) / Abstract (2) / Introduction (3-4) / Methods (5-15) / Results (16-22) / Discussion (23-26) / Other (27)
心理学场景叠加 APA JARS-Quant Table 9(MARS)12 处差异。
PRISMA 流程图(SSOT-PRISMA-FLOW-DIAGRAM)4 阶段强制:Identification → Screening → Eligibility → Included。
4.2.11 L12 综述自评(AMSTAR 2 + ROBIS)
systematic-review 强制 AMSTAR 2 自评:
- 16 项 7 关键域逐条自评
- 输出置信度等级(High / Moderate / Low / Critically Low)
- 严格模式目标 ≥ Moderate(最好 High)
- 学习模式不强制(但鼓励)
ROBIS(综述自身偏倚风险)作为 Tier 2 推荐项。
5 SubAgent 任务模板
详见 references/subagent-templates.md。顶层映射:
- L1 type-identification-agent / L2 pico-construction-agent / L3 protocol-registration-agent(各 1,串行前置)
- L4 search-strategy-design-agent + press-review-agent(串行)
- L5 search-execution-agent + dedup-agent + citation-tracking-agent(可并行)
- L6 screening-agent ×2 双盲 + arbitration-agent(2 并行 + 仲裁串行)
- L7 extraction-agent ×2 双人 + extraction-arbitration-agent(同 L6 编排)
- L8 rob-assessment-agent(1 或按设计分多个,可并行)
- L9 synthesis-agent / L10 grade-assessment-agent(各 1,串行)
- L11 writing-agent + reporting-agent + prisma-flow-agent + writing-process-archive-agent(4 个,串行;后两个为 W5_FIX_PLAN E.P1.5 新增)
- L12 amstar-self-assessment-agent + robis-agent(Tier 2)
总计 ~16-18 个 SubAgent(双盲/双人提取为最大并行峰值)。
6 派发 SubAgent 复制块 + references 加载(G5:填空题投放,非选择题加载)
机制(治病根,同 §3.1):实测一个 reference 被不被读,100% 取决于派发 prompt 是否点名它。故对载荷密集阶段(L6-L11),派发时把复制块整段贴进 SubAgent prompt(review-methodology-foundations/references/PROMPT-COPY-BLOCKS.md §C,前置其 §A 共享底座块 = LAUNCH-DIGEST §0/§2/§3)——关键载荷进 prompt(填空题),SubAgent 读不读深文件不再决定成败。下钻路径经 SSOT-INDEX.md 全库 resolver 解析(治 wrong-path;注意 L2-protocol-registration.md 实服务 L3、L1-question-construction.md 覆盖 L1+L2)。
| 阶段·动作 | 复制块 / references | 该阶段最高危载荷(一句) |
|---|
| L1 类型判定 / L2 PICO 构造 | references/L1-question-construction.md | 4 项判定矩阵;三层 PICO;FINER 5 项 |
| L3 协议起草 / 模式选择 | references/L2-protocol-registration.md(+ L3-mode-disclosures.md 披露) | 注册或显式未注册声明;协议偏离必记(禁 HARKing) |
| L4 检索策略 | references/L4-search-protocol.md | ≥4 库+PRESS;主题词+自由文本双轨 |
| L5 检索执行 | references/L5-prisma-s-execution.md | PRISMA-S 16 项;Bramer 6 步去重;命中数记录 |
| L6 双盲筛选 ×2+仲裁 | COPY-BLOCKS §C·L6 | 全文筛=双人硬点;κ≥0.60 仲裁 / <0.40 重做;自动预筛标准流程(追认④,§4.2.4) |
| L7 双人提取 ×2+仲裁 | §C·L7 | 双人 κ≥0.7 / ICC;8 类信息全覆盖 + 信度字段 |
| L8 RoB 评估 | §C·L8 | 工具×设计必配(RCT→RoB2 / NRSI→ROBINS-I / 单被试→SCED 非 SCRIBE / 单组前后测→ROBINS-I UBA);研究层×outcome 层两级 |
| L9 综合 SWiM/Popay | §C·L9 | 基于显著性的 vote count 禁令(Cochrane);PRISMA+SWiM 9 项;§4.2.8 切 MA 决策表 |
| L10 GRADE | §C·L10(L10-grade.md 住本 skill) | "研究数少"≠imprecision(用 OIS);升级前先 5 降级;SoF≤7 |
| L11 写作 ×4 | §C·L11 | PRISMA 27 项 + 24-27 不遗漏;流程图 4 阶段;Limitations ≥4 维 |
| L12 自评 | references/L12-amstar2-self-assessment.md | AMSTAR 2 16 项 7 关键域;任一失分 Critically Low |
| 写/查决策档案 | references/decision-provenance.md + COPY-BLOCKS §D | 规划文档=上下文容器(追认①,§3.3);禁自证式"已读"勾选 |
| 任何 Review-Agent 前 | references/quality-control.md | 跨阶段交叉对账(§14.3)+ 四铁律 |
subagent-templates.md = 各角色 6 段完整模板(on-demand 深潜;复制块 = 其"必读段"的即用压缩,主 Agent 无需先开模板即可派发)。
7 字数控制
字数公式与矩阵详见 review-methodology-foundations/references/SSOT-WORDCOUNT-RULES.md §3.1(综述类型 × 文献规模矩阵第 4 行:系统综述)+ §3.3(调整因子)+ §4(字数纪律)。本节不复制 SSOT 数字。
- 默认字数:12,000 字(SSOT §2.2 系统综述行);下限 8,000 字
- 三种确认模式:A(用户已指定 → 直接采用)/ B(未指定 → 默认 12,000 + 通知 + 不阻塞)/ C(自适应 → L7 完成后按 SSOT §3.1 矩阵估算)
- 严格 vs 学习模式:均按 SSOT §3.1 矩阵;严格模式下限 8,000 字
- 字数纪律:不硬凑 / 不铺陈 / 质量优先(详细定义见 SSOT §4)
- 字数严重不匹配阈值:参见 §11.6(应用 C2)
8 何时加载底座 SSOT(路径权威 = 全库 resolver)
路径唯一权威 = review-methodology-foundations/references/SSOT-INDEX.md(全库 file-resolver):阶段/关键词 → 唯一正确路径,覆盖三 skill 全部 references(治两次实战 wrong-path;跨 skill 归属陷阱见其 §B)。全文按需下钻时用 resolver 解析,不凭阶段编号直觉猜路径。SR 各阶段核心 SSOT:
| 阶段 / 决策点 | SSOT |
|---|
| 启动后立即(主 Agent 必读) | LAUNCH-DIGEST.md(≤10k 启动即必读,蒸馏三件套载荷 + §1.2-18 前沿条款六表);三件套全文(AI-FAILURE / LIFECYCLE / TERMINOLOGY)降级为按需下钻 |
| L1 类型决策 | SSOT-REVIEW-TYPES |
| L2 PICO 三层 | SSOT-PICO-FRAMEWORKS |
| L3 模式选择 | SSOT-MODE-PROFILES |
| L4 检索策略 | SSOT-SEARCH-STRATEGY |
| L5 PRISMA-S | SSOT-PRISMA-S-TEMPLATE |
| L6 流程图准备 | SSOT-PRISMA-FLOW-DIAGRAM |
| L7 提取字段 | SSOT-EXTRACTION-FIELDS |
| L8 RoB 工具映射 | SSOT-ROB-TOOL-MAPPING |
| L9 综合方法 | SSOT-SYNTHESIS-METHODS(如切到 MA 加 SSOT-EFFECT-SIZE-DECISION) |
| L10 GRADE | SSOT-GRADE-FRAMEWORK |
| L11 报告标准 | SSOT-REPORTING-STANDARDS(心理学叠加 SSOT-PSYCHOLOGY-SUPPLEMENTS) |
| L12 自评 | SSOT-AMSTAR-2-CHECKLIST |
| 心理学场景 | SSOT-PSYCHOLOGY-SUPPLEMENTS |
| 中文场景 | SSOT-CHINESE-CONTEXT |
| 字数 | SSOT-WORDCOUNT-RULES |
9 严格 / 学习 / 监督模式
参见 review-methodology-foundations/references/SSOT-MODE-PROFILES.md v2.0.0(系统综述子集 §4.4 + 三模式定义 §1)。
三模式速览:严格(顶刊投稿,全自动 + 人最终验收一次)/ 学习(课程作业,简化 + 抽样核查)/ 监督(§9.4:发表级方法学完整度 + 人在 7 不可逆点逐一签字把关)。监督模式见 §9.4。
9.1 严格模式(默认)
目标:顶刊投稿、循证临床、Cochrane 标准、AMSTAR 2 ≥ Moderate。
完整执行 12 阶段,全部 Tier 1(25 项)。Tier 2 推荐:PRESS、AMSTAR 2 自评、Open Science 披露。
9.2 学习模式(用户主动声明或场景判断)
目标:课程作业、开题报告、学习方法论、时间预算 ≤ 1 周。
简化的 11 项 Tier 1:
- 保留:L1 / L2 / L4(≥ 2 库)/ L5(简化布尔)/ L6(关键字段)/ L8(简化 3-4 项 RoB)/ L9(基础综合)/ L11(PRISMA 核心 8-10 条 + 流程图)
- 跳过但披露:L3(声明未注册)/ L4(PRESS)/ L6(双盲降级为单 SubAgent + 抽样人工核查)/ L10(GRADE 不强制)/ L12(AMSTAR 不强制)
学习模式 ≠ 不规范。三条硬约束:
- 保留 L1+L2+L11(类型识别、PICO、按报告标准写)
- 保留 PRISMA 流程图
- 综述末尾"Method Limitations"按 §9.3 披露原文模板逐条列出简化点
模式判定规则参见 SSOT-MODE-PROFILES §2.1(用户场景 → 推荐模式决策表)+ §4.2.1 L1 4 项判定矩阵。
9.3 学习模式 5 简化点的诚实披露原文模板(应用 C4 三段体例,W5_FIX_PLAN E.P0.6)
学习模式允许在 5 个简化点降级,但必须在主稿 Methods / Limitations 显式披露。每段披露含三段:教材原假设 / LLM 实现差异(≥ 3 处差异列举)/ 缓解措施 + Limitations 披露。
完整三段披露原文模板存放于 references/L3-mode-disclosures.md,主 Agent 在 L11 写作阶段加载该文件复制对应模板。5 个简化点:
| # | 简化点 | 嵌入主稿位置 | 教材依据 |
|---|
| 1 | 跳过 PRESS 同行评审(L4) | Methods §4.3 Search Strategy 末尾 | Cochrane v6.5 §4.4.5 |
| 2 | 双盲筛选降级(L6) | Methods §4.4 Selection Process 末尾 | Cochrane §4.6 + AMSTAR 2 Item 5 |
| 3 | 跳过 GRADE(L10) | Methods §4.11 Certainty Assessment + Discussion Limitations | Cochrane v6.5 Ch.14 |
| 4 | 跳过 AMSTAR 2 自评(L12) | Discussion Limitations 末尾 | Shea et al. 2017 BMJ |
| 5 | 协议未注册(L3) | Methods §4.0 Protocol and Registration | Cochrane v6.5 + AMSTAR 2 Item 2 (CD 1) |
每个简化点的完整三段披露原文("段 1 教材原假设 / 段 2 LLM 实现差异 ≥ 3 处 / 段 3 缓解措施")参见 references/L3-mode-disclosures.md。学习模式主 Agent 必须为本综述实际触发的简化点逐一嵌入对应模板(不允许"段 1+段 3"省略段 2)。
9.4 监督模式(Supervised Mode)
一句话:AI 把粗活干完(检索执行、双盲筛选、双人提取、初稿),人只在机器判不了的 7 个关键节点拍板——方法学和严格模式一样完整(PRISMA 2020 全 27 条 / AMSTAR 2 ≥ Moderate),但每个不可逆的决策都有人亲自签字担责。定义见 review-methodology-foundations/references/SSOT-MODE-PROFILES.md §1.4。
什么时候选它:教授/导师要的"AI 初编、人 check、确保不出错、达发表级"——既不放心让 AI 全自动一路跑过关键判断,又不能用课程级的随机抽查。一个研究者 + AI 协作产出可投稿的系统综述、但要逐点亲自把关时,选监督模式。
它和严格模式差在哪:方法学完整度一模一样(都是发表级 Tier 1 全覆盖),唯一区别是把"最后人验收一次"换成"7 个不可逆点各审一次"。系统综述侧,前几个签核点主要落在 L4 检索+纳排冻结、L6 筛选分歧、L7 提取校准/低置信(后续 L9/L11 解读与引用终审在切到元分析终点时由 meta-analysis 路径承接,见 §13.1)。每点产一张为它定制的审核卡,人看卡拍板"接受还是打回"。
为什么是"真门"而不是"提醒一下":每个签核点的裁决落进 decisions/ 对应文件的 user_signoff 标记。下游阶段启动前由 preflight 脚本读它——没签字 / pending / 打回 → 脚本退出码 ≠ 0,下游根本启动不了。同时 κ 由脚本算(不是 AI 心算)、可复现性硬检查(缺 sessionInfo / 退出码 ≠ 0 / κ 太低 / 种子召回不足)先于人审直接阻断。7 门的运行时操作契约(每门触发时机、产物路径、preflight 命令、缺签阻断哪个下游、硬检查、审核面上限)见 review-methodology-foundations/references/SUPERVISED-MODE-GATES.md。
平衡(两边都不过拟合):不处处拦人审——双盲一致项自动放行、κ 判 pass 且无红灯则该点无人审队列、可逆中间产物不设门;也不放任 AI 跑过关键判断——7 个不可逆冻结点、筛选分歧/提取低置信/关键数值必审。每个签核点待审条数设上限,超限收紧上游过滤而非把长清单甩给人。
签核体验(G1 vNext,2026-07-03 · 两段式):运行中=心流优先的知情确认(保留「(推荐)」预标+理由+后果+下钻+打回;不做负样本注入、不加考验摩擦),真正的独立人类审核在事后署名人审核包(L12.5)。卡/gate 合一(唯一人面文档=gate markdown 六段 a-f,HTML 卡为可选增强);判断点由结构化决策块单一源头驱动,signoff_ask.py 是唯一合规提问/回填通道(agent 不许手写 signed);preflight additive 强制同源 hash / 证据完备 / 叙事自洽 / 三字段。完整机制见 review-methodology-foundations/references/SUPERVISED-MODE-GATES.md §0.5。
披露:监督模式产出须披露"哪些步 AI 做、人在 7 签核点各审了什么"(RAISE:人类监督 + 透明披露 + 最终责任在人)。披露强度由签核事实(presented_via/evidence_opened/签字页状态)机读生成、单调不超过事实、语义用 attestation;两段式如实写作:in-run informed confirmations with drill-down access + post-hoc independent audit via structured audit package。详见 SSOT §6.6。
负责任使用(单一 SSOT):监督模式的立场、两段式监督模型、7 门与诚实边界的完整表述见发布仓根 RESPONSIBLE_USE.md——核心:AI 初编 + 人在 7 门签核 + 署名人负全责;运行中=知情确认(非独立判断),事后审核包=真正的独立人类审核;披露强度机读生成、单调不超过事实;不支持无人审核的自动投稿。
10 心理学场景与中文场景的特殊处理
10.1 心理学场景
触发条件:按 SSOT-PSYCHOLOGY-SUPPLEMENTS.md §0.4 4 类信号清单(APA 期刊 / 量表名 / 心理学构念 / 复制危机 + JARS 关键词)扫描,任 1 类命中即触发。判定结果(yes/no/boundary)写入 decisions/01_type_decision.md 心理学判定字段(决定 L11 是否叠加 JARS-Quant)。
参见 SSOT-PSYCHOLOGY-SUPPLEMENTS.md。SR 心理学场景额外要求:
- APA JARS-Quant Table 9(MARS)12 处差异(SSOT-REPORTING-STANDARDS §3)
- APA Thesaurus(PsycINFO)替代 MeSH
- 心理学元分析 8 议题(L9 切到 meta-analysis 时叠加)
- 复制危机响应:预注册声明、p-curve、Many Labs(SSOT-EXPERT-METHODOLOGY-INSIGHTS 维度 5)
按综合路径切换 JARS 子标准:L9 量化综合 → JARS-Quant Table 9(MARS);L9 质性综合(SWiM / 主题综合 / 元民族志)→ JARS-Qual Table 2 + ENTREQ;混合方法 → JARS-MM Table 1。
期刊投稿映射:Psychological Bulletin / Psychological Review → JARS-Quant Table 9 + APA 7 + Open Science;心理学报 / 心理科学进展 → 参照 SSOT-CHINESE-CONTEXT。
10.2 中文场景
参见 SSOT-CHINESE-CONTEXT.md。中文 SR 特殊要求:CNKI 检索语法 + 主题词;中文核心期刊综述格式(《心理学报》《心理科学进展》《管理世界》);GB/T 7714-2015 引用格式(vs APA 7);预注册可选"预见(PRECISE-CHINA)"+ PROSPERO 中文版。中文检索回退路径见 §11.1(检索主路径 paper-search-pro;中文 0 命中 → 人工导出 CNKI/万方题录 → ingest_search_exports.py 摄入;关键约束:不擅自降级英文检索代替中文检索)。
10.3 默认 RoB 工具选择的诚实披露(应用 C4,W5_FIX_PLAN E.P1.4)
主 Agent 在 L8 阶段使用按研究设计自动路由的 RoB 工具选择策略(教材依据:Cochrane v6.5 §8 / §25 / §28),需在主稿 Methods 节"Study Risk of Bias Assessment"嵌入完整三段披露(教材假设 / LLM 实现差异 ≥ 3 处 / 缓解措施 + Limitations 披露)。完整披露原文模板参见 references/L8-rob-assessment.md §"默认 RoB 工具选择的诚实披露"。
关键约束:单被试设计使用 SCED Scale 或 RoBiNT Scale(不是 SCRIBE — SCRIBE 是单被试报告指南,不是 RoB 工具)。详见 SSOT-ROB-TOOL-MAPPING §11.2/§11.3。
11 故障诊断与回退(应用 C2 模板)
本章节按"诊断信号 + 阈值 + 回退路径"三件套组织。故障切换决策写入 decisions/<阶段>_failure_switch.md。
11.1 检索主路径与回退(含中文场景)
检索主路径 = paper-search-pro Skill(OpenAlex / Semantic Scholar / CrossRef / PubMed 均走 HTTP API,需配置对应 API key,无需任何 MCP server)。若运行环境未提供 semantic-scholar / openalex MCP server(常见默认情况)——故障诊断以"paper-search-pro 检索结果异常"为准,不以"SS/OpenAlex MCP 报错"为准(该环境下这类报错不会出现)。中文检索因 OpenAlex/SS/CrossRef/PubMed 覆盖中文文献有限,主路径 = 用户人工导出 CNKI/万方 → scripts/ingest_search_exports.py 摄入。
| 故障信号 | 回退路径 |
|---|
英文检索 0 命中 / 召回过低(关键词为英文,paper-search-pro 命中明显不足) | 扩展同义词 / 放宽布尔逻辑重检;跨源交叉(OpenAlex↔CrossRef↔PubMed)补召回 |
中文检索经 paper-search-pro 0 命中(0 命中 + 关键词为中文) | (a) 用户人工导出 CNKI / 万方 / VIP 题录 → scripts/ingest_search_exports.py 摄入统一字段;(b) 已有文献集时转 literature-set-review。关键约束:SubAgent 不擅自降级英文检索代替中文检索 |
| 检索整体不可用(HTTP 持续失败 / 网络受限 / key 失效,持续失败 ≥ 3 次) | 阻断 + 警示用户 + 引导人工导出题录后走 ingest_search_exports.py + 不强行降级到本地推理凭记忆编造文献 |
| 检索结果元数据不完整(abstract 缺失 ≥ 50%) | 派发 firecrawl-abstract Skill 补抽(见下注降级路径) OR 扩展同义词重检索 |
firecrawl-abstract 降级注:若运行环境无 semantic-scholar MCP server → 该 Skill 的 paper_details(Semantic Scholar API / SS 法)通道不可用;默认走 Firecrawl Scrape / Firecrawl Extract 两法(Firecrawl key 在场可用),按 DOI / URL 抓取并解析摘要。
11.2 检索回报极端值(W5_FIX_PLAN E.P1.2)
identify_count > 50000 → 强制降级(不允许继续作为 SR),扩窄 PICO 或转 FO
identify_count > 10000 → 强烈建议降级(PICO 扩窄 / 切到 FO)
identify_count ∈ [5, 20) → 警示 + 询问用户是否扩展 PICO 或转 LS
identify_count < 5 → 阻塞 + 切到 LS 或扩展 PICO
引用 PRISMA-S Item 15-16 报告。
11.3 数据严重不足
- L7 数据可提取字段 < 50% → 主 Agent 仲裁;不能 → 切到 FO
- 含信度数据的研究 < 5(心理学元分析)→ 信度概化 sensitivity;Hunter-Schmidt 警示 + 抽样校正
- §4.2.1 4 项判定矩阵 = 1/4 → 切到 FO/LS
11.4 异质性极端 / 综合失败(W5_FIX_PLAN F.P1.4 协同)
I² > 75%(合并阻断)→ 不允许仅合并效应;改用 subgroup / meta-regression
I² > 90%(极端)→ 完全禁止合并 + 必须 subgroup / meta-regression / SWiM
k < 5 异质性高 → 不元分析,转 SWiM/Popay
应用 §4.2.8 L9 切换 MA 决策表执行。
11.5 双盲筛选 κ 异常 + 11.6 字数严重不匹配
- κ 异常(详见 §4.2.5):κ ≥ 0.60 仲裁不一致即可;0.40 ≤ κ < 0.60 仲裁 + 重审标准歧义;κ < 0.40 重做筛选。
- 字数严重不匹配(SSOT-WORDCOUNT-RULES §8):偏差 ≥ 30% 报告用户 + 建议调整;偏差 ≥ 50% 强制调整或转 Skill。
12 输出格式与文件命名
工作目录结构 <task_root>/工作产出/:
decisions/01_type_decision.md ... 11_reporting_standard.md(决策档案 11 类)
L1_type_identification.md / L2_pico_construction.md / L2_synonym_groups.md / L2_finer_check.md
L3_protocol_draft.md / L3_registration_statement.md
L4_search_strategy.md / L4_database_list.md / L4_grey_literature_plan.md
L5_search_records_<database>.csv / L5_search_documentation_<database>.yaml / L5_dedup_log.md / L5_final_records.csv
L6_screening_log.csv / L6_arbitration_log.md / L6_excluded_studies_with_reasons.csv
L7_extraction_<agentID>.csv / L7_extraction_final.csv / L7_extraction_consistency.md
L7_to_MA_field_mapping.md(SR L7 → MA L9.1 字段映射,W5_FIX_PLAN E.P1.6)
L8_rob_assessment.csv / L8_rob_summary_table.md / L8_traffic_light_plot.md
L9_synthesis_results.md
L10_grade_assessment.csv / L10_summary_of_findings.md
L11_manuscript.md(主稿)/ L11_prisma_flow_diagram.md(prisma-flow-agent 产出)/ L11_writing_process_archive.md(writing-process-archive-agent 产出)
L12_amstar2_self_assessment.md / L12_robis_assessment.md(严格模式 Tier 2)
final_quality_check.md
文件命名规则:L<N>_<task>.<ext>(与 LS PRES-016 NN_ 前缀风格平行)。
纯 SR 路径 L12 交付打包(G9 指针):纯 SR 终稿的交付打包与联合路径同一规范——①调 manuscript-typeset 默认产投稿四件(docx / PDF man / PDF jou / 干净 md,不待用户追加;四元组见 §13.4);②按 manifest 五节模板产 03_交付/00_交付清单_manifest.md(模板 = meta-analysis/references/delivery-manifest-template.md,住 meta-analysis 被本 Skill 引用;§3a 逐条覆盖①产出的 PLACEHOLDERS.md、§1 登记实产件数);③与 L12.5 审核包的 00_审核入口.md 分离互链,不合并(manifest = 投稿物索引;审核入口 = 署名人终审动线)。完整五步见 meta-analysis SKILL §12.4(联合路径 L12 归 MA,锁4 §4.4)。
13 与其他 Skill 的关系
13.1 配套关系(强推荐组合)
- systematic-review + meta-analysis:systematic-review 完成 L1-L8,meta-analysis 完成 L9-L12(量化合成 + GRADE + APA MARS 报告 + AMSTAR 2;锁4 §4.4:以元分析为终点的联合路径 MA 拥有 L9-L12)。投顶刊系统综述 + 元分析的标准组合。联合工作流路由:systematic-review L1-L8 → 应用 §4.2.8 L9 切换 MA 决策表 → meta-analysis L9-L12。
- systematic-review + ma-plots 渲染器 / ssci-plots:森林图、漏斗图属元分析路径(上条联合工作流,由 meta-analysis §13.2 内置渲染器产出);纯 SR 路径 L11 的 PRISMA 流程图 / RoB 图 = ma-plots 固定渲染器固定命令(
prisma_flow.py / rob_traffic.py + QC exit≠0,渲染器住 meta-analysis/scripts/plots/ 被本 Skill 引用,四元组见 §13.4);ssci-plots = 样式底座 + 非四件套通用统计图出口。
13.2 替代关系(用户选错时切换)
| 用户场景 | 应切换到 | 理由 |
|---|
| 只想探索领域、不要严格 PRISMA | field-overview-review | 探索式综述,无双盲、无 RoB |
| 想做 50 年发展史、领域演化 | field-evolution-review | 时间维度 + 5 维度检索 |
| 已有文献集、不再检索、无 PRISMA 要求 | literature-set-review | 跳过 L4-L5、增加输入质量自审 |
| 已有文献集、要 PRISMA / Cochrane | systematic-review(本 Skill) | 跳过 L4-L5 检索、保留 L1-L3 + L6-L12(消除与 LS 模糊地带) |
| 理论建构、构念分析、对立理论比较 | theoretical-review | 论证为主、方法宽松、Psychological Review 风格 |
| 只做量化元分析 | meta-analysis | 直接进 L9 量化(如已有完整数据) |
13.3 降级路径
如果用户初始想做系统综述但发现不可行(如检索回报量 > 50000、研究异质性极高、文献不足),主 Agent 应推荐降级:
- 降到
field-overview-review(整合综述路径)
- 或降到
literature-set-review(手头文献集驱动)
- 不允许在 systematic-review 中"压缩到 PRISMA 2 条"
13.4 卫星依赖矩阵(四元组硬契约 —— G9)
定位:同 meta-analysis SKILL §13.4——每个卫星调用锁成四元组命令行契约【何时调 / 命令或入口 / IO 契约 / 缺失时降级】,替代叙述性"联动"(E-Q4 病根:叙述性依赖可被合法绕开)。每行"缺失时降级"给明确阻断/降级动作,禁静默。路径 = skill-根相对路径;<skill> = 该 skill 根目录(严禁 runtime ~/.claude/skills/ 与裸相对 skills/)。
| 卫星 | 何时调 | 命令或入口 | IO 契约 | 缺失时降级 |
|---|
| paper-search-pro | L4/L5 检索主路径(L4 冻结签核后执行检索) | Skill 工具显式加载并触发(HTTP API:OpenAlex / Semantic Scholar / CrossRef / PubMed,key 已配,无 MCP) | 进:检索式。出:题录导出(BibTeX/RIS/CSV)→ scripts/ingest_search_exports.py 摄入;外包路线时回执先过 scripts/validate_exports.py 硬门(exit≠0 不摄入,§4.2.4) | → §11.1 回退表(中文 0 命中 → 人工导出 CNKI/万方 → ingest 摄入;整体不可用 → 阻断警示、不凭记忆编造文献)+ G6 检索请求包人工路线(§4.2.4)。本行指针即可,不复述 §11.1 |
| document-to-markdown + paper-downloader-portable | L6 纳入判定后、L7 提取前(全文下载 + PDF→MD 转换) | G6 全文请求包机制(不直接调 CLI):主 session 产 fulltext_request_pack/(download_list CSV + download_policy.yaml + 自包含执行 Prompt)外包给可插拔执行器(§4.2.6;模式 = review-methodology-foundations/references/OUTSOURCING-HANDOFF-PATTERN.md) | 进:download_list.csv + download_policy.yaml(allow_scihub 一次性预先点头 / 渠道白名单 8 枚举 / 依赖档位)。出:回执按 meta-analysis/references/FULLTEXT-RECEIPT-FORMAT.md(8 字段 fulltext_receipt.csv + 人读清单;住 meta-analysis 被本 Skill 引用,resolver §B #9);scripts/validate_fulltext.py 硬门验收(exit≠0 不摄入;--receipt --policy 渠道纪律 fail-closed) | G6 依赖档位(download_policy.downloader.tier):本地 paper-downloader-portable 优先;缺 → 第三方下载 skill(G10 依赖矩阵选定,档位占位)或 manual-only 手工逐库指引。d2m(执行 Prompt 必需转换器)缺 → 换具备 d2m 的执行器,或转换缺件如实进回执 + 主 session 阻断消费并披露——主 session 不回退自己下载/转换 |
ma-plots(住 meta-analysis/scripts/plots/ 被本 Skill 引用,非独立 skill) | 纯 SR 路径 L11 的 PRISMA 流程图 / RoB 图(联合路径产图归 MA L11,见 §13.1) | python3 <meta-analysis>/scripts/plots/prisma_flow.py --counts <prisma_counts.yaml> --out <stem>;python3 <meta-analysis>/scripts/plots/rob_traffic.py --data <rob_domains.csv> --labels <labels.csv> --tool both --out <stem>(--tool 亦可 rob2 / robins;CLI 签名权威 = meta-analysis/scripts/plots/README.md) | 进:meta-analysis/references/prisma-flow-contract.md(counts YAML)/ (domains CSV)。出: + ;退出码 0/1/2/3,。同 MA §13.2: 从特征表 / ID 对照卡机械生成并落盘、;交付验收抽行核"显示名↔study_id↔数值三方一致" |
14 Skill 独有方法学章节
14.1 学习模式简化点的诚实披露
学习模式 5 简化点的完整 C4 三段披露见 §9.3。
14.2 默认 RoB 工具选择的诚实披露
按研究设计自动路由的披露见 §10.3(含 SCED/RoBiNT vs SCRIBE 修正)。
14.3 跨阶段交叉对账(PRES-004 多角度验证保留)
阶段间交叉对账机制(防漏防错)参见 references/quality-control.md §2-§3:
- L2 → L4 / L4 → L5 / L5 → L6 / L6 → L7 / L7 → L8 / L8 → L10 / L9 → L10 / L10 → L11 / L11 → L12
15 参考文档清单
15.1 教材基础:Cochrane Handbook v6.5(2024)/ Cooper 5e Research Synthesis and Meta-Analysis(2017)/ Higgins et al. Cochrane Handbook / Borenstein et al. Introduction to Meta-Analysis 2e(2021,配套 meta-analysis Skill)/ JBI Manual for Evidence Synthesis(2024,质性证据综合)。
15.2 报告标准:PRISMA 2020(Page et al. 2021 BMJ,27 条 + 4 阶段流程图)/ PRISMA-S(Rethlefsen et al. 2021 Syst Rev,16 项)/ PRISMA-P(Moher et al. 2015,17 项协议预注册)/ AMSTAR 2(Shea et al. 2017 BMJ,16 项 7 关键域)/ GRADE Working Group(Cochrane Ch.14 + GRADE Handbook)/ ROBIS(Whiting et al. 2016 J Clin Epidemiol)。
15.3 风险偏倚工具:RoB 2(Cochrane v6.5 Ch.8,RCT 5 域)/ ROBINS-I(Ch.25,NRSI 7 域)/ QUADAS-2(诊断)/ NOS(队列/横断)/ CASP / JBI Qualitative(质性)/ COSMIN(测量工具)/ SCED Scale / RoBiNT Scale(单被试设计 RoB 工具;SCRIBE 是单被试报告指南,不是 RoB 工具)。
15.4 SSOT 引用清单
本 Skill 通过引用而非粘贴使用 review-methodology-foundations 的 20 个 SSOT。完整 SSOT × 阶段映射参见 §8 + review-methodology-foundations/references/SSOT-INDEX.md。简表:SSOT-REVIEW-TYPES(L1)/ SSOT-LIFECYCLE-12-PHASES(全)/ SSOT-METHODOLOGY-TERMINOLOGY(弱)/ SSOT-AI-FAILURE-DEFENSES(全 必读)/ SSOT-EXPERT-METHODOLOGY-INSIGHTS(仲裁)/ SSOT-PICO-FRAMEWORKS(L2)/ SSOT-SEARCH-STRATEGY(L4)/ SSOT-PRISMA-S-TEMPLATE(L5)/ SSOT-PRISMA-FLOW-DIAGRAM(L6/L11)/ SSOT-EXTRACTION-FIELDS(L7)/ SSOT-EFFECT-SIZE-DECISION(L9 切 MA 时)/ SSOT-ROB-TOOL-MAPPING(L8)/ SSOT-SYNTHESIS-METHODS(L9)/ SSOT-GRADE-FRAMEWORK(L10)/ SSOT-REPORTING-STANDARDS(L11)/ SSOT-AMSTAR-2-CHECKLIST(L12)/ SSOT-PSYCHOLOGY-SUPPLEMENTS(心理学场景)/ SSOT-CHINESE-CONTEXT(中文场景)/ SSOT-MODE-PROFILES(L3)/ SSOT-WORDCOUNT-RULES(L11)。
16 变更记录
- 2026-06-10(v1.1.1):修复轮 F10–F17(依据 = 2026-06-10 实测审计)。新建
review-methodology-foundations/references/SSOT-INDEX.md(修复本文件 §8 / §15.4 的断链引用);subagent-templates / L6 / L7 中的硬编码模型名参数化(规范性语句改为"当前可用的最强模型",披露模板原文改为按会话如实填写的占位符)。
- 2026-06-20(S4 WP-C 编排修补):§2.4 / §4.2.8 / §13.1 联合路径 L10-L12 措辞消歧——按锁4 §4.4 裁定,以元分析为终点的联合路径由 meta-analysis 完成 L9-L12(GRADE/报告/AMSTAR2 由 MA 产),纯 SR 路径仍 SR 完成 L10-L12(原"回 systematic-review 完成 L10-L12"在切 MA 场景与 MA §12.1 交付物清单冲突,已消歧)。SR L7→MA L9.1 字段映射表(
L7-extraction-dual.md §11)由 S4 同步重写对接 MA L9.1 §8.2 输入契约(关 BK-2)。
- 2026-06-23(S6B WP-E② 监督模式):关 BK-9。§9 标题改"严格 vs 学习"→"严格 / 学习 / 监督" + 三模式速览,新增 §9.4 监督模式(= 严格方法学完整度 + 人在 7 不可逆点 SP1-SP7 结构性强制门决策审核;何时选=教授诉求"AI 初编+人 check 达发表级";SR 侧签核点主要落 L4 检索冻结/L6 筛选/L7 提取,L9/L11 在切 MA 终点时由 MA 路径承接;真门=preflight 缺签 exit≠0 + κ 由脚本算 + 硬检查先于软评;平衡=两边都不过拟合 + 审核面上限;披露=RAISE 人类监督+透明+最终责任);指向操作契约
review-methodology-foundations/references/SUPERVISED-MODE-GATES.md + SSOT-MODE-PROFILES v2.0.0。用户面文字按 meta-analysis/scripts/CARD_NARRATIVE_VOICE.md 精神去黑话。仅改 §9(OWNER_MAP §2.2 段落 owner),未触碰其余章节。
- 2026-06-23(S7 WP-F Lane A 检索回退一致化):关 doc 12c P2-3/P2-4。§11.1 检索回退表去除运行环境不存在的 SS MCP 假信号(
batch_search 报错 / phantom limit / fields 类型 / "SS MCP 不返回 CNKI"),主路径改为 paper-search-pro(HTTP,OpenAlex/SS/CrossRef/PubMed key 已配)/ 中文人工导出 CNKI 万方 → scripts/ingest_search_exports.py 摄入;保留真实回退(中文 0 命中→人工导出+摄入/转 literature-set-review、整体不可用→阻断警示不凭记忆编造、元数据补抽)与关键约束"不擅自降级英文检索代替中文检索";§3.4/§10.2 检索回退 cross-ref 同步去 SS MCP 框架。新增 firecrawl-abstract SS 法降级注:运行环境无 SS MCP → paper_details(SS 法) 不可用,默认走 Firecrawl Scrape/Extract 两法。仅改 §3.4/§10.2/§11.1(OWNER_MAP §2.2 S7 段落 owner),未触碰其余章节。
- 2026-07-04(G5 必读投放与瘦身):治实战病根"references 39.3% 从未被读 / 三件套被跳 2/3 / 被读率=派发 prompt 点名的函数"。①**§3.1 启动即必读改指
LAUNCH-DIGEST.md(≤10k)(蒸馏三件套 ≈72k 载荷 + §1.2-18 前沿条款六表,三件套/深层全文降级按需下钻);②§6 从"何时加载"改"派发复制块"(关键载荷经新建 PROMPT-COPY-BLOCKS.md §C 整段进 SubAgent prompt = 填空题构造性保证,最高危载荷一句内联本表);③§8 路径权威改指 SSOT-INDEX.md 全库 resolver**(阶段→绝对路径,治 L10/L11/L12 住 SR 被 MA 引用的两次 wrong-path);④好偏离追认(公理 8):追认①规划文档=上下文容器(§3.3)+ 追认④验证式自动预筛标准流程(§4.2.4 指针 + L6-screening-dual-blind.md §12 新节:种子 100% 保全 + 双重假阴抽验 + Methods 披露,不替代双盲/全文双人);⑤required_readings 保字段砍报表 + 禁自证式"已读"勾选(模板删 + preflight --gate readings 一行 WARN)。仅改 §3.1/§6/§8/§3.3/§4.2.4/§16,未触碰 §9.4+§4.2.5(G1)/§11.1(S7)/其余章节。
- :①新增 (五行四元组硬契约:paper-search-pro[L4/L5 主路径,降级指针 §11.1 不复述] / document-to-markdown+paper-downloader-portable[G6 全文请求包 §4.2.6 + download_policy 依赖档位] / ma-plots[:纯 SR 路径 L11 的 PRISMA/RoB 图固定命令+QC exit≠0+labels 机械同源纪律] / manuscript-typeset[纯 SR L12 默认投稿四件] / academic-ref-check[引用终审 fail-closed];每行降级明确禁静默);②§13.1 "systematic-review + ssci-plots" 行事实同步(森林图/漏斗图归 MA 路径;纯 SR PRISMA/RoB 图 = ma-plots 固定渲染器;ssci-plots = 样式底座 + 通用统计图出口);③§12 尾新增纯 SR 路径 L12 交付打包指针 blockquote(manifest 五节模板住 MA 被 SR 引用 + 投稿四件 + 与 分离互链;详 meta-analysis SKILL §12.4)。纯 additive/措辞事实同步:避开 §9.4+§4.2.5(G1)/§11.1(S7)/§4.2.4+§4.2.6 G6 blockquote/G5 owned §3.1/§6/§8/§3.3/L6 §12;S4 的 §12 命名规则行与 §13.1 联合工作流行一字未动。④: L8 RoB 输出行(发表级图=rob_traffic.py)+ 11.3 prisma-flow-agent 步骤 6 改 prisma_flow.py 固定命令+失败回退改"明确报告缺什么、草稿不得当交付图" / :338 effect direction plot 指针化(ssci-plots 通用图出口正确角色)。⑤critic 交叉复核后加修:§12 打包指针 blockquote (typeset①→manifest②,治依赖倒置); :152 与 :189/:207/:327 漏网 ssci-plots 活指令改固定渲染器契约指针。