| name | audit-biomedical-paper-evidence |
| description | 审读用户提供的生命科学或生物医学论文、PDF、摘要、正文、figure、panel、caption 或截图,定位核心科学问题,逐图解释实验设计和证据链,审计机制、因果性、rescue、方法边界、正交验证与局限。材料缺失时请求补充或转介检索;不提供医疗建议、临床决策或可直接执行的湿实验 SOP。 |
生命科学论文证据审读
范围守卫
仅在以下条件同时满足时执行论文证据审读:
- 用户提供至少一项可读的目标材料:PDF、摘要、正文、figure、panel、caption 或截图;
- 请求涉及科学问题、实验设计、逐图解读、机制链、因果性、rescue、方法比较、证据强度或研究局限;
- 当前材料足以支持相应层级的判断。
若只有标题或 DOI,先请求目标材料;仅在用户明确授权且存在独立检索通道时转交检索任务,
不得声称已读取未提供的全文。医学诊断、治疗选择、个体化用药、可直接执行的湿实验步骤、
剂量和危险操作不在范围内;不得为临床决策索取患者个人资料。作者语气或人格模仿也不在范围内。
何时使用
- 用户提供论文 PDF、摘要、正文或片段,要求定位核心问题、实验设计和主要结论。
- 用户提供 figure、panel、caption 或截图,要求解释变量、坐标、分组、对照、读出、观察和 panel 逻辑。
- 用户要求梳理机制链,并区分相关性、方向性、必要性、充分性和因果性。
- 用户要求评价 rescue、回补、抑制剂逆转或遗传互作是否恢复关键表型。
- 用户要求比较实验方法、正交验证、缺失对照、替代解释和外推限制。
- 用户希望先用匿名示例理解检查方法,再把同一组检查问题用于其提供的目标材料。
必需输入
至少一项用户提供的目标论文材料。若用户未指出具体问题,先从可见材料中识别:
- 待检验的科学问题;
- 论文作者的主要主张;
- 当前材料覆盖的 figure、panel、结果段或方法段;
- 无法读取或缺失的部分。
输入处理与能力边界
- PDF:文本环境先提取正文、caption 和方法;若无法直接查看图像,明确说明逐图判断仅基于文本。
- 视觉材料:优先使用清晰截图、高分辨率 figure 或 PDF 内可辨认图像。分辨率不足或 panel 边界不清时,只完成可支持的局部分析。
- 仅有 legend 或正文:可以重建实验意图和文字所述结果,但涉及坐标、颜色、点分布或图像形态的判断必须标为文本推断。
- 不可见内容:不得依靠模型记忆补出目标论文未展示的数据、统计设置或结论。
工作流
- 冻结材料范围:列出实际可见的正文、caption、figure 和 panel,以及当前无法判断的部分。
- 定位主问题:用一句话说明论文或当前 figure 正在检验什么,以及论文作者提出了什么主张。
- 识别证据阶段:判断每个实验属于候选筛选、定向验证、表型确认还是机制验证;不要把筛选命中直接升级为机制。
- 逐 panel 解读:识别子问题、实验类型、自变量、因变量、分组、对照、读出、直接观察、论文作者解释和分析者判断。
- 连接 panel 逻辑:判断 panel 之间是递进、并列、验证、反证还是存在断点,并建立有方向的证据链。
- 审计因果性:分别检查 gain-of-function、loss-of-function、时间或方向证据、必要性、充分性和替代解释。
- 审计 rescue:明确起始扰动、回补方向、作用层级、恢复的关键表型、对照和特异性;出现
rescue 一词不等于因果链成立。
- 比较方法:说明每种方法直接测量什么、能支持什么、不能支持什么,以及不同方法是否独立检验同一主张。
- 分层表达证据:始终分开审读规则与判断依据、目标材料证据、推断或待验证假设。
- 给出克制结论:列出支持范围、缺失对照、替代解释、外推限制和最小下一步验证问题,不提供可直接执行的湿实验 SOP。
判定边界
- 通路图、数据库预测和相关性分析只能生成候选关系,不能单独证明机制。
- 单向敲低或敲除、单个抑制剂、单一标志物变化不能自动建立完整因果链。
- rescue 必须检查方向、层级、关键表型、对照和特异性;代理指标恢复不等于核心表型恢复。
- Co-IP、pulldown、WB、定位、功能实验和动物实验回答的问题不同;方法数量多不等于正交验证充分。
- 体外与体内证据具有不同适用层级,应评价模型相关性和外推边界,而不是仅按实验类型机械排序。
- 匿名示例只用于解释检查方法,不得替代目标材料中的实际证据。
输出模板
- 核心科学问题与论文作者主张
- 目标材料范围与无法判断项
- 逐 panel / 逐证据分析:问题、设计、对照、读出、观察、论文作者结论
- 机制链与 panel 逻辑
- 因果性与 rescue 审计
- 方法矩阵与正交验证
- 替代解释、缺失对照和外推限制
- 下一步验证问题
- 证据分层:审读规则与判断依据 / 目标材料证据 / 推断或待验证假设
停止条件
- 材料不可读或不足以支持某项判断:停止该项判断,保留可完成的局部分析,并列出需要补充的内容。
- 只有标题或 DOI:不分析全文,请求材料或在获得明确授权后转交独立检索任务。
- 用户要求用匿名示例或外部机制替代目标材料:拒绝事实迁移,只保留检查框架。
- 用户要求医疗或临床决策、湿实验 SOP、危险操作或作者风格模仿:停止或转介到合适任务。
Reference routing
- 证据分层、因果性和逐图审读框架:
references/evidence-audit-framework.md
- 筛选、机制、rescue 和方法边界的匿名模式:
references/method-audit-patterns.md
Evaluation boundary
使用 evals/trigger-cases.json、evals/task-cases.json 和 evals/rubric.json 检查范围、
缺口诚实、证据锚定、因果克制、方法边界、安全停止和输出可用性。结构检查和测试定义
不能替代真实任务表现,也不能证明实际 Wisp 发现、解析或启用状态。