一键导入
paper-survey
中文学术综述报告自动生成 — 系统化完成多论文文献调研并产出 11 章 markdown 综述报告(含 LaTeX 公式可渲染)。集成 paper-search 自动检索下载、K 路并行 subagent 解析、reviewer 双层质量审查、跨 session 自动恢复。
用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
菜单
中文学术综述报告自动生成 — 系统化完成多论文文献调研并产出 11 章 markdown 综述报告(含 LaTeX 公式可渲染)。集成 paper-search 自动检索下载、K 路并行 subagent 解析、reviewer 双层质量审查、跨 session 自动恢复。
用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
基于 SOC 职业分类
| name | paper-survey |
| description | 中文学术综述报告自动生成 — 系统化完成多论文文献调研并产出 11 章 markdown 综述报告(含 LaTeX 公式可渲染)。集成 paper-search 自动检索下载、K 路并行 subagent 解析、reviewer 双层质量审查、跨 session 自动恢复。 |
TRIGGER 关键词:「文献调研」「综述报告」「research survey」「literature review」「调研报告」「学术综述」 / 任何要求多论文系统化整理 + 正式 markdown 报告输出的场景。
SKIP(不要使用本 skill):单篇论文阅读 / 简单论文检索(用 paper-search) / 不需要正式综述报告的快速摘要 / 仅需要论文清单 PDF 下载(用 paper-search)。
中文学术综述报告自动化 skill。9 个流程节点 / 6 个主阶段全自动流程,每主阶段 implementor + reviewer 双 subagent 质量门控(0b 综述选择由主 Claude 内联检查),跨 session 可恢复,集成 paper-search。
启动检测 (-1) ─────────── spec.md 当前阶段字段权威 + 文件存在性辅助 + AskUserQuestion 确认
↓
头脑风暴 (0a) ─────────── 与用户对话对齐主题、范围、深度、模板分支、cwd 工作目录
↓
预调研 (0b) ───────────── 下载 1-3 篇主线综述 → 主 Claude 阅读 → pre_survey_notes.md
(无独立 reviewer,主 Claude 内联 regex 验引文)
↓
写 spec (0c) ──────────── spec_writer 生成 survey_spec.md + spec_reviewer 验证 + 用户最终确认
↓
检索下载 (1) ──────────── 按 spec 清单批量下载 PDF + 立即按 naming_convention 重命名
+ 下载校验(size/标题/作者 fuzzy)+ 自动重试 ≤2
+ paper_search_reviewer 验证元数据匹配
↓
并行解析 (2) ──────────── K 路 paper_extractor 并行(D 分组+β 时序)
→ 全完后串行 K 路 extract_reviewer 验证
↓
报告骨架 (3) ──────────── outline_writer 写 outline.md(严格标题+fenced JSON block)
+ outline_reviewer 抽样幻觉验证
↓
md 组装 (4) ───────────── python assets/assemble_md.py <workdir>(源路径直调,不复制)
→ outline.md 中间产物渲染为顶层 <topic>_综述报告.md
→ 内置 dry-run:fenced JSON parse + LaTeX $/$$ 配对
↓
完成度核查 (5) ─────────── validation.py 跑 17 项(16 项机械 + 1 项消费 reviewer 报告反幻觉)
validation_reviewer 用 ~49 处 verify_quotes_batch 并行 ≈ 2 秒,输出 reviewer 报告
↓
交付(用户口头确认)
关键约束:
每次 skill 调用第一步执行。spec.md 当前阶段字段是权威状态源,文件存在性是辅助验证(不一致时 AskUserQuestion 升级用户)。
| spec.md 状态 | 当前阶段字段 | 文件存在性 | 推断阶段 |
|---|---|---|---|
| 不存在 | — | 无任何子目录 | 0a 新开 |
| 不存在 | — | _pre/ 已下载 | 0b 进行中(续上从 pre_survey_extractor) |
| 不存在 | — | _work/pre_survey_notes.md 存在 | 0c 写 spec |
| 存在 | 0c-completed | _pre/ 与 _work/extracts/ 空 / 顶层无 *.pdf | 阶段 1 |
| 存在 | 1-completed | 顶层 *.pdf 非空,_work/extracts/ 空 | 阶段 2 |
| 存在 | 2-completed | _work/extracts/ 全有,_work/outline.md 缺 | 阶段 3 |
| 存在 | 3-completed | _work/outline.md 存在,<topic>_综述报告.md 缺 | 阶段 4 |
| 存在 | 4-completed | <topic>_综述报告.md 存在,_reviews/validation_report.md 缺 | 阶段 5 |
| 存在 | 5-completed | 全部存在 + 17/17 PASS | 完成 |
| 存在 | 字段缺失 | — | 用文件存在性回退推断 |
| 存在 | 字段与文件存在性矛盾 | — | AskUserQuestion 升级用户 |
| 损坏(解析异常) | — | — | AskUserQuestion 升级用户 |
{cwd}/ 下子目录,识别 <topic>/ 工作目录AskUserQuestion:「检测到现有任务:[A] {topic-A} 阶段 X / [B] {topic-B} 阶段 Y。请选续哪个 / 新开 / 重跑某主题」每阶段完成必做:主 Claude 完成某阶段后立即 Edit _work/survey_spec.md 的 ## 当前阶段 段为 {N}-completed,作为下次 session 的恢复锚点。
目标:与用户对话对齐:
关键确认:必须复述工作目录绝对路径让用户确认,避免在代码仓库根目录误落 50 篇 PDF 污染 git。
目标:下载 1-3 篇主线综述,主 Claude 阅读后形成 pre_survey_notes.md。
步骤:
{cwd}/<topic_slug>/(含子目录 _pre/ 与 _work/)paper-search search "{topic} survey OR review OR tutorial" -n 5 -s arxiv,crossref,openreview,doaj
_pre/,按 naming_convention 重命名pre_survey_extractor subagent 产出 _work/pre_survey_notes.mdAskUserQuestion 阈值(0b):严格——综述检出 fuzzy < 80% / 多候选 / 0 命中都问
失败处理:默认源返 0 → fallback 加 semantic → 仍 0 则降级"高引论文+奠基工作" + AskUserQuestion 复述
目标:生成 <workdir>/_work/survey_spec.md 契约文件。
步骤:
spec_writer subagent_work/pre_survey_notes.md + 0a 对话纪要 + 用户已知清单paper-search search 补全每条论文的 arxiv_id(fuzzy ≥ 80% 直采)AskUserQuestion 批量问(β 合并)spec_reviewer subagent 验证(结构合规 + 论文清单完整 + 关键词覆盖)失败处理:reviewer FAIL → γ 修复 + 重试 ≤2
目标:按 spec 清单批量下载所有 PDF。
AskUserQuestion 阈值:严格——任一论文 fuzzy < 80% / 多候选 / 0 命中 / 元数据不匹配 → 批量问
步骤:
<workdir>/ 顶层(与 <topic>_综述报告.md 同层平铺)paper_search_reviewer subagent 验证命名 + 元数据匹配目标:K 路 implementor 并行解析所有 PDF。
派发规则(D 分组 + 二级切分):
β 时序:
Agent(subagent_type="general-purpose") 调用 paper_extractor<workdir>/_reviews/group_<group_id>_review.mdFAIL 处理:仅重派失败那一路,γ 修复 + 重试 ≤2
目标:合并所有 extracts → outline.md。
步骤:
outline_writer subagent(严格标题层级 + 第 5/7 章 fenced JSON block)_work/extracts/*.md + _work/pre_survey_notes.md + _work/survey_spec.mdpython -c "import json; ..." dry run 验证所有 fenced JSON block(assemble_md.py 阶段 4 也会再次自检)outline_reviewer 验证(结构合规 + 反幻觉抽样 + 引用对齐)目标:把 outline.md 中间产物渲染为顶层 <topic_slug>_综述报告.md(含 LaTeX 公式)。
步骤:
python <skill-path>/assets/assemble_md.py <workdir>
<skill-path> 表示本 skill 的安装目录(即包含本 SKILL.md 的目录)的绝对路径,由主 Claude 在运行时解析(不要硬编码到具体用户机器路径)。<workdir>/<topic_slug>_综述报告.md{"status": "ok", "path": "...", "size_bytes": ..., "cn_chars": ..., "papers": ..., "refs": ...}$ / $$ 配对(行内偶数 + 行间偶数)_work/outline.md 修 JSON\$ 数量 + 定位漏闭合目标:17 项核查全 PASS 才算完成。FAIL 上限 3 次。
步骤:
validation_reviewer subagent 跑反幻觉抽样(~49 处 verify_quotes_batch 并行 ≈ 2 秒)→ <workdir>/_reviews/validation_review.mdpython <skill-path>/assets/validation.py <workdir> --reviewer-report <workdir>/_reviews/validation_review.md(<skill-path> 含义同阶段 4)<workdir>/_reviews/validation_report.md,列每项 PASS/FAIL_work/survey_spec.md 当前阶段为 5-completed,向用户口头汇报{cwd}/<topic_slug>/
├── 2022_CoRL_R3M.pdf # 顶层论文 PDF(命名规范,平铺)
├── 2022_arXiv_RT1.pdf
├── ...
├── <topic_slug>_综述报告.md # 顶层最终交付(阶段 4 输出)
├── _pre/ # 0b 预调研综述 PDF
│ └── 2025_arXiv_<survey>.pdf
├── _work/ # 过程文件
│ ├── survey_spec.md # 0c 输出
│ ├── pre_survey_notes.md # 0b 输出
│ ├── outline.md # 3 输出(含 fenced JSON)
│ └── extracts/
│ ├── group_<group_id>_<paper_index>.md
│ └── _tmp_<group_id>_<paper_index>_full.md
└── _reviews/ # reviewer 报告
├── spec_review.md # 0c reviewer
├── paper_search_review.md # 1 reviewer
├── group_<group_id>_review.md # 2 reviewer
├── outline_review.md # 3 reviewer
├── validation_review.md # 5 reviewer
├── validation_report.md # 5 综合报告
├── _validation_claims.json
└── _validation_results.json
关键约定:
*.pdf(论文)+ <topic_slug>_综述报告.md(最终交付)两类文件_pre/ _work/ _reviews/ 三个下划线前缀子目录assemble_md.py 与 validation.py 直接以 <skill-path>/assets/... 形式从 skill 安装目录调用,不复制到工作目录paper-survey 通过 paper-search skill 完成所有检索/下载,详见 references/paper_search_cheatsheet.md。
CLI 模式(要求 paper-search 已在 PATH 中可用;安装方式见 paper-search skill 自身文档):
paper-search <command> [args]
spec_template.md / naming_convention.mdassemble_md.py(阶段 4 markdown 组装入口,标准库无依赖)pdf_extraction.py(含 verify_quotes_batch 并行 CLI)validation.py(17 项核查 + reviewer-report 参数 + 弹性字数档)subagent_prompts/:9 个 prompt 模板
pre_survey_extractor.md / spec_writer.md / spec_reviewer.mdpaper_search_reviewer.md / paper_extractor.md / extract_reviewer.mdoutline_writer.md / outline_reviewer.md / validation_reviewer.mdreport_structure_11chapters.md:11 章 markdown 渲染规范markdown_formula_convention.md:LaTeX 公式契约(行内/行间分隔符 + 中文紧邻空格 + 强制级别)gb_t_7714_format.md:参考文献格式paper_search_cheatsheet.md:paper-search 命令速查field_extraction_schema.md:字段抽取契约 + 阶段 5 抽样规则(含公式抽样)troubleshooting.md:md 时代失败模式(LaTeX 配对 / fenced JSON / pipe table)〔p.{页码}: "{≤30字}"〕,未定位 → N/A-源文本未覆盖