| name | paper-author-landscape |
| description | | Use when this capability is needed. |
开始前: 先说一声 "开始整理作者/机构图谱 🧭"。
论文作者机构图谱
用于在论文总结之后补一层“这篇 paper 背后的学术版图”,
也用于把一组已有论文串起来,整理成跨论文的作者 / 机构版图。
重点不是机械列作者名单,
而是回答:
- 这篇论文的作者和机构各自主要在做什么
- 一组现有论文背后,哪些作者 / 机构在重复出现
- 这个方向还有哪些人在持续做
- 哪些实验室/机构值得长期跟踪
- 这些判断分别基于什么证据
Step 0: 接收输入
支持以下输入:
| 输入 | 示例 | 处理方式 |
|---|
| 论文笔记路径 | /path/to/note.md | 直接读取笔记 |
| arXiv / DOI / 论文标题 | https://arxiv.org/abs/... | 先读取论文基本信息 |
与 paper-reader 联用 | “读一下这篇并分析作者机构” | 先完成总结,再做本 skill |
| 笔记目录 / 当前库 | “现在有的论文”“这个目录里的论文” | 扫描一组笔记,做跨论文汇总 |
如果当前回合已经触发 paper-reader,
默认把它的总结结果当上游输入继续往下做,
不要让用户重复提供同一篇论文。
如果用户说的是“现在有的论文”“当前笔记库”“最近写过的几篇论文”,
默认进入汇总模式,
先扫描已有笔记,再做跨论文图谱。
Step 0.5: 先判断模式
本 skill 统一处理两种模式:
- 单篇模式
- 输入是一篇论文、一个 arXiv 链接、一个标题,或者由
paper-reader 刚读完的一篇论文
- 输出是“这篇 paper 背后的作者 / 实验室 / 机构图谱”
- 汇总模式
- 输入是一组已有论文笔记,或者用户明确说“分析现在有的论文”
- 输出是“当前关注方向里,哪些作者 / 机构在重复出现,哪些组值得长期跟踪”
如果用户没有明确给路径,但上下文里已经有一组现有论文,
优先以这组论文作为汇总模式输入。
Step 1: 先把“领域范围”定清楚
不要一上来就搜作者名字。
先根据论文标题、摘要、方法、实验对象,
把这篇 paper 的领域范围压缩成 3 个层次:
- 核心问题:
这篇论文到底在解什么问题
- 方法家族:
它属于 [[Flow Matching]]、[[Schrödinger bridge]]、[[Optimal Transport]]、[[Spatial Transcriptomics]]、perturbation prediction 还是别的什么
- 应用场景:
它是在做单细胞、空间组学、理论生成建模、还是其他领域
输出时必须显式写一句:
“这里的‘对应领域’我按 问题 + 方法 + 应用场景 三层来界定。”
这样后面不会把“碰巧用了同一个关键词”的人也算进去。
如果是汇总模式:
- 先对每篇论文分别做一次
问题 + 方法 + 应用场景 归纳
- 再提炼出它们的交集和并集
- 最后明确写出“这次汇总的范围边界”
例如:
“这次汇总我按 single-cell perturbation / spatial omics / transport-based generative modeling 的交集来组织,不把更泛的生成模型圈全部纳入主名单。”
Step 2: 抽取直接证据
先只处理这篇目标论文本身。
至少整理出:
- 作者列表
- 机构列表
- 一作 / 通讯作者 / 核心合作关系(如果论文或主页能判断)
- 每个机构在这篇工作里扮演的角色
注意:
- 不要因为机构名很强就自动脑补方向。
- 不要把挂名合作单位和真正持续在做该方向的组混为一谈。
- 如果作者抽取损坏,优先用 PDF、作者主页、机构页面补齐。
如果是汇总模式,
先对每篇笔记分别整理:
- 作者列表
- 机构列表
- 是否存在通讯作者 / 核心合作关系
- 该 paper 对应的核心问题和方法家族
然后再统计:
- 哪些作者在多篇同方向论文里反复出现
- 哪些机构在多个相关主题里连续出现
- 哪些合作关系不是一次性共现
Step 3: 扩展到“这个方向谁在做”
这是本 skill 的核心。
3a. 先从论文内部扩展
优先从这些地方扩展候选名单:
- 本文作者最近 1-3 年同方向论文
- Related Work / Baseline / Concurrent Work 里反复出现的人名和机构
- 同一机构下与该主题重复共现的实验室或 PI
3b. 再做外部验证
这一步默认需要联网查证。
优先使用:
- 作者个人主页
- 实验室主页
- 机构官方 publication/news 页面
- arXiv / PubMed / OpenReview / 项目主页
把聚合站点、转述文章、榜单类页面只当线索,
不要当最终证据。
3c. 分类输出
把结果分成 3 桶:
- 直接同方向:
和目标论文问题高度重合,且近期持续产出
- 方法近邻:
方法家族高度重合,但应用场景不完全一致
- 机构信号强:
单篇之外,同一机构在这个主题上连续出现
不要把所有人混成一个长名单。
如果是汇总模式,
还要额外标出:
- 当前库中重复出现:
在你现有笔记里直接重复出现,或跨论文承担稳定角色的作者 / 机构
Step 4: 明确“为什么把他/它算进来”
每个作者或机构都至少要给出一条证据。
推荐格式:
人/组/机构
为什么算进来
代表论文或项目
时间信号
判断置信度
如果只是推断,
必须明确写成“推断”,
不要伪装成事实。
Step 5: 输出结构
默认按下面 5 段输出。
详细模板见 references/output-template.md。
单篇模式
A. 这篇论文的作者与机构
回答:
- 作者来自哪些机构
- 哪些作者最像这个方向的核心推进者
- 这篇工作更像单组深耕还是跨组合作
B. 这个方向有哪些人在做
用 作者 / 实验室 / 机构 三层列出。
每层都只保留最相关的一批,
宁缺毋滥。
C. 值得长期跟踪的组
这部分要更强调“持续性”而不是“只发过一篇”。
D. 机构观察
看的是:
- 哪些机构在这个方向上形成了连续产出
- 哪些机构是方法源头
- 哪些机构更偏应用落地
E. 不确定性和边界
明确说明:
- 哪些判断是直接证据
- 哪些判断是基于近期论文和合作网络的推断
- 哪些作者/机构虽然相关,但没有纳入主名单
汇总模式
A. 当前汇总范围
回答:
- 这次汇总纳入了哪些论文
- “对应领域”是怎么定义的
- 哪些主题在主范围内,哪些只算近邻
B. 当前库里的作者与机构概览
回答:
- 这组论文涉及哪些作者和机构
- 哪些作者 / 机构在当前库里重复出现
- 哪些合作关系值得特别关注
C. 当前库中重复出现的作者 / 组 / 机构
优先列出:
- 在多篇现有论文里反复出现的人
- 在不同问题上都保持存在感的机构
- 不是只共现一次的合作关系
D. 这个方向有哪些人在做
用 作者 / 实验室 / 机构 三层列出。
每层都只保留最相关的一批,
宁缺毋滥。
E. 值得长期跟踪的组
这部分要更强调“持续性”而不是“只发过一篇”。
F. 机构观察
看的是:
- 哪些机构在这个方向上形成了连续产出
- 哪些机构是方法源头
- 哪些机构更偏应用落地
G. 不确定性和边界
明确说明:
- 哪些判断是直接证据
- 哪些判断是基于近期论文和合作网络的推断
- 哪些作者/机构虽然相关,但没有纳入主名单
Step 6: 回填到论文笔记(可选但推荐)
如果输入对应一篇现有论文笔记,
或当前回合本来就在生成论文笔记,
则在笔记里追加以下 section:
## 作者与机构图谱
## 这个方向谁在做
## 值得长期跟踪的组
规则:
- 如果 section 已存在,更新而不是重复追加
- 不要破坏原有
## 关键公式 / ## 关键图表 / ## 实验结果 结构
- 如果只做对话回答、用户没要求保存,可以不落盘
如果是汇总模式且用户要求保存,
优先新建或更新一篇总览笔记,
文件名可用:
作者与机构图谱总览.md
内容至少包含:
## 当前汇总范围
## 当前库里的作者与机构概览
## 当前库中重复出现的作者 / 组 / 机构
## 这个方向谁在做
## 值得长期跟踪的组
## 机构观察
## 不确定性和边界
重要约束
- 不要按名气列人
只因为是 famous lab 并不代表就在做这篇 paper 对应的问题。
- 不要按机构名脑补方向
必须给论文、项目或主页证据。
- 不要把一次性合作写成长期布局
判断“机构在做”要看连续产出。
- 必须区分事实和推断
例如“这位作者是该方向核心人物”通常是推断,不是原文事实。
- 时间要具体
需要写清楚是
2024-2026 的近期工作,还是更早的历史贡献。
- 汇总模式不能只做计数
“出现次数最多”不等于“最值得跟踪”,必须结合论文主题和持续性判断。
参考文件(按需查阅)
references/output-template.md — 单篇模式 / 汇总模式的推荐输出格式、证据等级和简短示例
Source: AI4Science-WestlakeU/Frontiers-in-Computer-Science-and-Technology-2026 — distributed by TomeVault.