一键导入
claim-verification
对一段陈述/视频/文章/分析报告做真实性验收:拆解论点链 → 联网核查关键数据 → 找出反方证据 → 输出可点击的 8 维度红绿灯诊断与最终客观判断。当用户说"帮我看看这个说法靠不靠谱 / 验证真实性 / 反方观点是什么 / 这是不是泡沫 / 帮我做一个验收 / 这观点合理吗"时调用。
用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
菜单
对一段陈述/视频/文章/分析报告做真实性验收:拆解论点链 → 联网核查关键数据 → 找出反方证据 → 输出可点击的 8 维度红绿灯诊断与最终客观判断。当用户说"帮我看看这个说法靠不靠谱 / 验证真实性 / 反方观点是什么 / 这是不是泡沫 / 帮我做一个验收 / 这观点合理吗"时调用。
用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
基于 SOC 职业分类
Use when the user asks to correct English prompts, broken English, typos, grammar, wording, tone, workplace English, business writing, presentation language, or asks for English practice, quizzes, or help expressing ideas clearly in English.
Use when 用户要求提取、提炼、总结某个日期或时间范围的群聊/聊天记录(EACC 投资群 / eacc-chat),生成群聊日报、核心话题分析或投资价值信息筛选。触发词:提取聊天记录、群聊提炼、群聊总结、某月某日群里聊了什么、chat digest、群聊日报、群聊干货。
评估或对比会议纪要/访谈整理/深度纪要的质量:对照原始转录核查保真度,盘点覆盖度,输出多维度打分与失真清单。适用时机:(1) 用户问"这两份纪要哪份质量更高/写得更好",(2) AI 生成的纪要发布前验收(有没有幻觉、编造、立场写错),(3) 给纪要挑毛病/做质检/打分。触发语:评估纪要质量、对比纪要、纪要靠谱吗、纪要验收、纪要打分、哪份纪要好。
对会议纪要/活动回顾/访谈整理等将对外发布的文档做敏感信息检查与脱敏,覆盖查塔姆宫规则(Chatham House Rule)合规:人名机构名及变体、职级暗示、玩笑话与人事信号、点评同行、口语化敏感词、外链击穿匿名、身份指纹拼图、第三方未公开信息、编辑残留。适用时机:(1) 纪要将对外发布/进知识库/发群前,(2) 嘉宾或机构方要求脱敏审稿,(3) 用户提到查塔姆规则/讲事不讲人/匿名化/敏感信息检查。输出违规清单+修复建议,或直接执行脱敏。
Use when designing or reviewing lifecycle status fields, finite state machines, async task/order/payment/upload/approval workflows, or when states are overlapping, action-shaped, ownerless, unsafe under retries, concurrency, timeouts, or terminal-state updates.
深度研究与验证技能:当用户提出需要多源信息搜集、逻辑推理和事实验证的复杂问题时使用。 适用场景包括但不限于:投资研究、行业分析、技术对比、政策解读、商业决策支持等需要 "先想清楚怎么查,再去查,查完还要验证"的场景。 触发关键词/短语:为什么A而不是B、分析一下、帮我研究、设计一个SOP流程来回答、 深度分析、请验证、fact check、多角度分析、请先理解问题再回答、不要立即回答。 当用户明确要求"先设计研究流程再回答"或"验证你的结论"时,务必使用此技能。 当用户的问题涉及多个实体的比较(公司、技术、政策等)且答案不是简单事实时,也应触发。
| name | claim-verification |
| description | 对一段陈述/视频/文章/分析报告做真实性验收:拆解论点链 → 联网核查关键数据 → 找出反方证据 → 输出可点击的 8 维度红绿灯诊断与最终客观判断。当用户说"帮我看看这个说法靠不靠谱 / 验证真实性 / 反方观点是什么 / 这是不是泡沫 / 帮我做一个验收 / 这观点合理吗"时调用。 |
把"一段有结论的内容"(视频转录、公众号文章、研报、社交媒体长帖、他人分析报告、自己写的草稿)当成被告,执行结构化的真实性验收流程:
核心价值:把"读完很有道理"的内容,过一遍反爆款过滤器,让用户拿到一个 6 个月后回看也站得住脚的判断。
满足以下任一即调用:
youtube-video-analysis 输出 report.md 之后,被显式 hand off 做事实核查不适用场景:
meeting-minutes-deep-extraction 或直出)out/<videoId>__<slug>/ 的视频 workspace 时,必须遵守 AGENTS.md §1。$WS/verification.md(与 report.md / note.md 并列),禁止覆盖既有文件、禁止写到 out/ 根。file:// 链接必须指向当前 workspace 内文件;跨 workspace 引用需显式注明"对照基线"。目标:把整篇内容压缩成 3-7 条断言(A/B/C/...),形成可验收的最小单元。
动作:
Step 1 产出物:
断言 A:……(事实层 / 因果层 / 判断层)
└ 关键论据 a1: ……
└ 关键论据 a2: ……
└ 隐含假设 a*: ……
目标:对所有数字、事件、引用做 ≥2 个独立信源交叉验证。
动作:
Step 2 产出物:事实核查表(断言编号 × 是否属实 × 信源链 × 议程标注)。
目标:检查"因为 X 所以 Y"的因果方向是否唯一/最强。
动作:
Step 3 产出物:因果归因对比表(原文主因 vs 替代解释 1/2/3 + 各自证据强度)。
目标:主动找出最强反方论据(而非稻草人版反方)。
动作:
Step 4 产出物:≥3 个反方立场 + 每个立场的论据 + 对原结论的破坏力评分。
目标:给出"事实 / 机制 / 判断"三层独立打分 + 实操建议。
动作:
Step 5 产出物:最终客观判断 + 可证伪指标清单 + 元方法论。
| 维度 | 检查项 | 通过标准 |
|---|---|---|
| AC-1 事实层 | 关键数字是否在 ≥2 个独立信源交叉验证 | 🟢 全部对得上;🟡 大致对但有截断;🔴 单一源/无法验证 |
| AC-2 来源层 | 数据源头是否有政治/商业议程,原文是否披露 | 🟢 无议程或已披露;🟡 有议程未披露但影响小;🔴 议程化数据被包装为权威 |
| AC-3 因果层 | 原文主因是否是唯一/最强解释 | 🟢 唯一最强;🟡 主因之一但被夸大;🔴 倒果为因或忽略政策/外生冲击 |
| AC-4 框架层 | 借用的理论指标在同一语境(同国/同方法论)下是否成立 | 🟢 同语境;🟡 跨语境但仍可类比;🔴 指标移植谬误 |
| AC-5 反方层 | 是否陈述并驳斥最强反方(≥3 类) | 🟢 学术+市场+方法论全覆盖;🟡 提到但未深入;🔴 完全缺席或只打稻草人 |
| AC-6 隐含假设层 | 是否把"幸存者偏差"案例当趋势证据 | 🟢 无;🟡 有但已加免责;🔴 把孤例当趋势 |
| AC-7 规模层 | 异常资金流/数据点是否大到足以构成系统信号 | 🟢 占大盘 >X% 有意义;🟡 边际;🔴 < 0.1% 却被说成"潮" |
| AC-8 预测层 | 是否给出可证伪的触发条件 | 🟢 给出明确指标+阈值;🟡 给出方向无阈值;🔴 模糊预言 |
判定规则:
| 编号 | 标准 |
|---|---|
| D-1 | 必须包含 Step 1-5 的全部产出物,不允许跳步 |
| D-2 | 事实核查表每行必须有可点击信源链接 |
| D-3 | 反方立场必须 ≥3 类,且用 steelman 笔法 |
| D-4 | 8 维度红绿灯表必须完整填写 |
| D-5 | 最终判断必须分"事实/机制/判断"三层独立打分 |
| D-6 | 必须给出至少 1 条"可证伪的真正预警指标" |
| D-7 | 所有 file:// 链接指向当前 workspace 内文件 |
| D-8 | 对在世人物的判断性内容,区分"主张/事实/推论",避免事实化传谣 |
一手源 > 二手转载 > 自媒体加工。同一份韩联社数据被 5 家媒体转载,仍然算 1 个独立源。必须沿信源链回溯到"数据生产者"(央行 / 统计局 / 议员办公室 / 公司财报 / 学术原文),并标注其议程属性。
任何数据都有生产者,任何生产者都有目的。反对党议员办公室的数据可以用,但必须显式标"出自反对党议员办公室,目的是攻击执政党政策"。原文未披露的,本 skill 必须补上。
反方必须用反方自己最有说服力的版本陈述,禁止稻草人。如果反方论据强到能动摇原结论 30% 以上,必须在最终判断中显式反映。
借美国指标证韩国/中国市场风险 = 红色警报。任何"达利欧说" / "巴菲特指标" / "席勒 PE" 在跨国/跨周期应用时,必须先问"本土版本数值是多少",未给出本土数据就用别国指标做警示,自动降级到 🔴。
当现象同时受政策外生冲击(限购、加息、补贴)和市场内生反馈(情绪、估值、配置)驱动时,必须分开归因并标权重。混在一起讲的就是伪深度。
被描述为"潮 / 浪 / 趋势"的资金流/人群行为,必须算占大盘的比例。< 0.1% 不构成趋势,只是统计噪音被叙事化。
最终判断必须给出可证伪的指标 + 阈值 + 时间窗。"可能反转 / 值得警惕 / 已现端倪"这类模糊语必须翻译成"如果 X 指标在 Y 时间内突破 Z 阈值则证伪"。给不出的,自动降级。
"事实层 90% 准确 + 因果层 60% 误读 + 判断层 30% 牵强"是典型爆款配方。验收报告必须把这三层分开打分,避免"事实对所以结论对"的传染性谬误。
对每个反方立场打分:能否(a)削弱论据强度(b)翻转因果方向(c)推翻最终判断。三项打勾越多,原结论越脆弱。
本 skill 不站队。既不为了"打脸"而过度否定(用户可能恰好爱看),也不为了"温和"而打折扣评估。打分按证据给,不按情绪给。
# 🔍 真实性验收报告|<主题>
> **被验收对象**: <原文路径 / URL / 视频 ID>
> **验收日期**: 2026-MM-DD
> **验收依据**: claim-verification SOP v1
---
## 总判(30 秒结论)
<3-5 句话,包含:核心断言 + 红绿灯总分 + 最大缺陷 + 替代解读>
---
## Step 1|论点链拆解
- 断言 A(事实层): ……
- 断言 B(因果层): ……
- 断言 C(判断层): ……
- 隐含假设: ……
---
## Step 2|事实核查表
| # | 原文论据 | 状态 | 信源链 | 议程标注 |
|---|---|---|---|---|
| 1 | …… | ✅/🟡/⚠️/❌ | [源A](url) + [源B](url) | …… |
---
## Step 3|因果归因审查
| 断言 | 原文归因 | 替代解释 1 | 替代解释 2 | 主因权重 |
|---|---|---|---|---|
---
## Step 4|反方立场(Steelman)
### 反方 1:学术反方
…… [论据链接](url)
**破坏力**: 削弱论据 ☑ / 翻转因果 ☑ / 推翻判断 ☐
### 反方 2:市场反方
……
### 反方 3:方法论反方
……
---
## Step 5|8 维度红绿灯诊断
| 维度 | 检查项 | 红绿灯 | 说明 |
|---|---|---|---|
**红绿灯总分**: X 绿 / Y 黄 / Z 红 → <可信赖 / 需修正 / 经不起验证>
---
## 综合判断(三层独立打分)
- **事实层准确率**: NN%
- **机制层准确率**: NN%
- **判断层准确率**: NN%
**真正应该盯的可证伪指标**:
1. ……(阈值 X,时间窗 Y)
2. ……
**给读者的元方法论**: <一句话能带走的判断框架>
research-to-knowledge-note)