research-frontier
研究方向发现引擎。在成熟领域的交界处发现没人建的桥。 触发条件: "找方向"/"研究方向"/"选题"/"下一轮做什么"/"research frontier"。 核心方法: 资产盘点 → 结构选型 → 交叉缝隙扫描(deep research驱动) → 证据验证 → 可行性确认。
用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
菜单
研究方向发现引擎。在成熟领域的交界处发现没人建的桥。 触发条件: "找方向"/"研究方向"/"选题"/"下一轮做什么"/"research frontier"。 核心方法: 资产盘点 → 结构选型 → 交叉缝隙扫描(deep research驱动) → 证据验证 → 可行性确认。
用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
基于 SOC 职业分类
AI 科研军团统一入口。用户投入任何科研任务→Wei 读取任务→查阅 Skill 注册表→动态调度各角色。 触发条件: 用户说"/start-army"、"启动军团"、"接单"、"开始项目",或提供数据文件+研究需求。
原始数据真伪与异常模式扫描。既支持 /data-forensics,也支持自然语言触发,如‘这份数据可信吗’。
数据探查与画像。30分钟生成完整数据画像,包括变量字典、分布、缺失率。既支持 /data-profiler,也支持自然语言触发,如‘先帮我看看这份数据长什么样’。
最终交付收口。把投稿包整理成可交付目录,补齐说明文件、清单和接收指引。既支持 /delivery,也支持自然语言触发,如‘把这些整理成最终交付目录’。
学术论文撰写。基于统计结果和文献生成IMRAD格式论文。既支持 /manuscript-draft,也支持自然语言触发,如‘帮我写成论文初稿’。
质量审查与自动迭代。多轮审查直到通过或达到上限。既支持 /quality-review,也支持自然语言触发,如‘帮我审这篇稿子’。
| name | research-frontier |
| description | 研究方向发现引擎。在成熟领域的交界处发现没人建的桥。 触发条件: "找方向"/"研究方向"/"选题"/"下一轮做什么"/"research frontier"。 核心方法: 资产盘点 → 结构选型 → 交叉缝隙扫描(deep research驱动) → 证据验证 → 可行性确认。 |
| allowed-tools | Read, Write, Edit, Bash, Glob, Grep, WebSearch, WebFetch, Agent |
在两个成熟领域的交界处,找没人建的桥。
不是在热门领域里找增量选题,而是系统性地扫描领域交叉的缝隙,用 deep research 验证空白真实存在,用数据可行性确认能做,用竞争窗口判断该不该现在做。
传统选题: 领域内文献综述 → 找gap → 做增量研究(拥挤)
本方法: 多领域资产图谱 → 交叉缝隙扫描 → deep research验证空白 → 锁定蓝海
2026-03-20 实战验证:从8个已完成训练任务出发,通过多元思维格栅分析 → 交叉领域缝隙扫描 → deep research 验证,锁定"环境化学暴露→代谢→心理健康"三段通路方向。该方向经系统搜索确认为完全空白(三段串联中介分析=零篇论文),且数据(NHANES)、方法(BKMR-CMA)、发表窗口(12-18个月)三者齐备。
frontier_report.md — 完整调研报告(含证据链接)candidate_directions.json — 结构化的候选方向清单(排序+评分)requirements.md用户触发("找方向"/"选题"/"下一轮做什么")
│
▼
Phase 1 ──→ asset_map.md ──→ Phase 2
(输入适配) (可能为空) (结构选型)
│
用户注入偏好 ←── "要空白的"/"要争议性的"/...
│
▼
Phase 3 (deep research)
搜索 3-5 个候选方向的文献饱和度
│
▼
空白评分排序 ──→ 得分≥12 的进入 Phase 4
│
▼
Phase 4 (deep research)
数据可行性验证
│
▼
Phase 5 (deep research)
竞争 + 期刊 + 窗口
│
▼
Phase 6 综合报告
│
▼
用户决策 → requirements.md × N
目标: 理解"我们已经有什么",避免从零开始。也可能什么都没有,这完全合法。
Phase 1 的第一步是判断用户给的是什么,再决定怎么提取信息:
用户输入
│
▼
输入类型检测
│
├── A. 路径 → 是项目目录?
│ 扫描 progress.md / requirements.md / outputs/
│ 提取: 暴露变量、结局变量、中介变量、数据集、分析方法
│ → 生成 asset_map.md
│
├── B. 路径 → 是数据文件 (CSV/XPT/Excel)?
│ 读取列名 + 数据画像(行数、变量类型、缺失率)
│ 匹配已知数据集特征(如含 SDMVPSU → NHANES)
│ → 生成 asset_map.md(仅含数据资产,无研究资产)
│
├── C. 文本 → 含 DOI 或论文标题?
│ 搜索论文摘要,提取变量关系(暴露→结局)
│ 以该论文为种子,识别其引用网络中的变量空间
│ → 生成 asset_map.md(以论文为锚点)
│
├── D. 文本 → 是领域描述("心理健康"/"环境流行病学")?
│ 无本地资产,Phase 1 输出 asset_map = 空
│ Phase 3 改为从公开数据集变量空间广撒网搜索
│ → asset_map.md 为空(标记 source: "领域描述")
│
├── E. 文本 → 是数据集名称("NHANES"/"BRFSS")?
│ 加载该数据集的已知变量清单/模块清单
│ 标注变量类别(暴露/结局/协变量)
│ → 生成 asset_map.md(仅含数据集能力图谱)
│
└── F. 无输入 / "帮我找方向"?
加载可用公开数据集清单(NHANES/BRFSS/CHARLS/CFPS/MIMIC/...)
每个数据集标注核心变量域
→ asset_map.md 为空 + 附可用数据集清单
输出: asset_map.md(变量关系图 + 主题频次 + 数据集覆盖矩阵。可能为空。)
目标: 确定研究矩阵的骨架类型,并获取用户的方向性约束。
三种经典结构:
| 结构 | 逻辑 | 鲁棒性 | 学术影响力 | 终局产出 |
|---|---|---|---|---|
| 暴露驱动 | 一个X → 多个Y | 高(共享数据) | 中 | 伞状评价 |
| 结局驱动 | 多个X → 一个Y | 高(单篇独立) | 中 | 系统综述+PAF |
| 机制链 | A→B→C→D 串联 | 低(链条脆弱) | 高 | 理论贡献 |
| 混合(推荐) | 主轴+嵌入机制线 | 中高 | 高 | 综述+原创框架 |
操作:
这一步不可跳过。 必须向用户确认或从用户输入中提取:
偏好约束直接影响 Phase 3 的搜索策略和评分权重。例如"要空白的"会把空白评分权重从 25% 提升到 50%。
输出: 推荐的结构类型 + 用户偏好约束(传递给 Phase 3)
这是整个流程的核心引擎。不是拍脑袋猜空白,而是系统搜索验证空白。
操作:
3a. 生成候选交叉点
根据 asset_map 是否为空,采用不同策略:
精准模式(asset_map 非空): 从变量关系图中,识别所有"两端成熟但中间无桥"的变量对:
对于资产图中的每个变量A:
对于每个可能的变量C(来自不同领域):
如果 A→B 已有文献(领域1成熟)
且 B→C 已有文献(领域2成熟)
则 "A→B→C 串联" 是一个候选交叉点
广撒网模式(asset_map 为空): 从可用数据集的变量域出发,枚举跨领域组合:
对于每个可用数据集:
列出其核心变量域(如 NHANES: 环境化学物/代谢/心理/营养/人口学)
对于每对变量域 (域A, 域B):
如果 域A 和 域B 属于不同的传统学科
则 "域A → 域B" 是一个候选交叉方向
→ 启动 deep research 评估该方向的文献饱和度
广撒网模式会产生更多候选方向,因此 deep research 的第一轮搜索只做快速饱和度判断(搜索结果数),过滤后再对 top 5 做深入搜索。
3b. Deep Research: 饱和度评估(每个候选方向)
启动 deep-research-agent,对每个候选方向执行:
搜索任务 1: 通路各段的文献量
- "{变量A} AND {变量B}" 的 PubMed/Google Scholar 结果数
- "{变量B} AND {变量C}" 的结果数
- "{变量A} AND {变量C}" 的结果数(直接关联)
- "{变量A} AND {变量B} AND {变量C}" 的结果数(三段串联)
搜索任务 2: 是否已有系统综述/meta-analysis
- "systematic review" OR "meta-analysis" + 各段关键词
- 如果三段串联已有综述 → 该方向不空白,降级
搜索任务 3: 最近2年的最接近论文
- 2024-2026年发表的、与该交叉点最相关的论文
- 这些论文的结论中是否提到了"future research should..."
- 有人插路标但没人走 = 最佳窗口
搜索任务 4: 是否有人提出过这个假说
- 搜索概念性综述、评论文章、预印本
- 如果假说已被提出但无实证 = 高价值空白
- 如果假说未被提出 = 可能是开创性方向,也可能是因为不合理
3c. 空白评分
| 维度 | 1分(放弃) | 3分(可做) | 5分(蓝海) |
|---|---|---|---|
| 两端成熟度 | 一端也不成熟 | 一端成熟一端有数据 | 两端均有meta-analysis |
| 中间空白度 | 已有综述 | 有零散论文(<10篇) | 串联分析=零 |
| 路标信号 | 无人提及 | 综述中mention过 | 有人明确标注为gap |
| 时效性 | 2年前就有人标注 | 1年内标注 | 最近6个月标注 |
输出: 候选方向排序(按空白评分)
只对 Phase 3 中得分 ≥12 的候选方向执行。
启动 deep-research-agent:
搜索任务 1: 变量覆盖
- 目标数据集中,关键变量是否存在?哪些cycle/波次?
- 变量的测量方式是否一致(跨cycle可比性)?
搜索任务 2: 样本量估算
- 所有关键变量同时有数据的样本量
- 子样本(如NHANES的1/3生物监测子样本)的瓶颈
- 是否足以支撑混合暴露分析的统计功效
搜索任务 3: 方法学工具
- 这个场景下主流的统计方法是什么?
- 是否有现成的软件包/R包/Python库?
- 方法论文是否已被广泛引用(>50次 = 审稿人接受)
输出: 可行性评估(数据充分/部分可行/不可行)
搜索任务 1: 竞争团队
- 哪些研究组在做最接近的工作?
- 他们的发表节奏(每年几篇?正在加速?)
- 竞争窗口估算: 按现有发表速度,空白还能维持多久?
搜索任务 2: 目标期刊
- 该交叉领域的期刊有哪些?IF范围?
- 这些期刊最近是否发表过类似交叉研究?(编辑接受度)
- 综述/终局论文的最佳投稿目标
搜索任务 3: 政策/临床影响力
- 这个方向如果做出来,对公共政策有什么含义?
- 是否有正在进行的政策辩论可以借力?
输出: 竞争格局 + 期刊策略 + 影响力评估
将 Phase 1-5 的结果综合,生成最终报告:
# 研究方向调研报告
## 候选方向排序
| 排名 | 方向 | 空白评分 | 数据可行性 | 竞争窗口 | 综合推荐 |
|------|------|---------|-----------|---------|---------|
## 推荐方向详述
### 宏大叙事
[一段话描述整个研究矩阵的故事]
### 研究矩阵设计
[8篇论文的布局 + 论文间引用关系]
### 风险评估
[主要风险 + 缓解策略]
### 决策点(需要人判断)
[方向/数据/期刊等需要用户选择的关键决策]
Phase 1 Phase 2 Phase 3
asset_map.md ────────→ structure_type ────────→ candidate_gaps[]
(变量关系图, (暴露驱动/结局驱动/ (每个候选方向含:
可能为空) 机制链/混合) 两端文献量,
+ 串联文献量,
user_preferences 最近论文,
(空白/争议/增量, 空白评分)
领域/数据约束)
│ │ │
│ ┌──────────────────┘ │
│ │ │
▼ ▼ ▼
如果为空 → Phase 3 切换为广撒网模式 得分≥12的进入 Phase 4
如果非空 → Phase 3 用精准模式
Phase 4 Phase 5 Phase 6
data_feasibility ────→ competition_report ───→ frontier_report.md
(变量覆盖, (竞争团队, (完整报告)
样本量估算, 期刊分层, +
方法学工具, 竞争窗口, candidate_directions.json
瓶颈标注) 政策影响力) (结构化排序)
│
▼
用户决策
│
▼
requirements.md × N
(直接输出为训练任务需求)
| 上游 | 本模块 | 下游 |
|---|---|---|
| 已完成的研究任务 / 数据文件 / 论文 / 领域描述 / 无 | research-frontier | training-curriculum.md(训练任务矩阵) |
| idea-analyst(Phase 2 结构分析时调用) | 调用其格栅分析能力 | requirements.md(每个任务的需求) |
| — | Phase 3/4/5 各自启动 deep-research-agent | evo-loop.sh(执行训练循环) |