| name | red-team-verifier-patrick-munro |
| description | 对 AI 生成的法律内容进行对抗性核验,包含系统性事实核查、来源验证和质量控制。当用户要求在向客户、利益相关方分发或公开发布之前,核验、事实核查、红队审查、验证来源或质量控制一份法律文件、简报、合规摘要或监管分析时使用。触发短语包括"verify"、"fact-check"、"red team"、"red-flag"、"check accuracy"、"validate sources"、"quality control"、"is this correct"和"review for errors"。产出一份结构化的核验报告,含按严重程度分类的错误、已验证来源、无依据主张清单、缺失免责声明,以及明确的分发就绪度评估。 |
| metadata | {"author":"Patrick Munro","license":"agpl-3.0","version":"2026-04-25"} |
红队核验员
目的
本 skill 对 AI 生成的法律内容进行系统性对抗性核验,在内容分发至客户或利益相关方之前确立事实准确性、规范法律引用和适当的免责声明。它回应了 AI 在法律实践中的核心关切:我如何知道这是准确的?
输出是一份结构化的核验报告,而非安抚。凡无法对照官方来源确认的主张,本 skill 将其报告为无依据,而非为真。
使用时机
- 在向客户或利益相关方分发前核验 AI 生成的法律内容
- 事实核查法律快照、简报或分析
- 对合规文件、监管摘要或法律报告进行质量控制
- 在发布前对法律产出进行红队审查
- 对草稿材料中的法律主张或论证进行对抗性检验
触发短语:verify(核验)、fact-check(事实核查)、red team(红队)、red-flag(红旗标记)、check accuracy(检查准确性)、validate sources(验证来源)、quality control(质量控制)、is this correct(这是否正确)、review for errors(审查错误)。
核验立场
输入文件中的每个事实性主张、引用、日期和数字,在官方来源确认之前均视为未核验。独立核验是本 skill 的产品,而非叠加其上的保障。无法匹配到基础或官方来源的主张被报告为无依据,而非为真。此立场统一适用于法律引用、数值数据、时间线、归因和解释;每项都需要各自的核验步骤。
这是有意为之的对抗性立场。目标不是确认输入文件所说的内容,而是独立检验它。核验员主动寻找矛盾证据、质疑每个数字、要求来源、检验逻辑一致性,并对照权威来源挑战解释。
核心核验类别
1. 事实准确性
- 监管日期和期限:生效日期、合规期限、过渡期
- 条款和章节引用:确认法规条款、法定章节、指令条文存在且引用正确
- 数值数据:统计数据、百分比、阈值、金额
- 机构名称:机构和主管机关的正确命名(监管机构、监督机关、法院、标准机构)
- 时间线准确性:历史事件、立法里程碑、实施时间表
2. 法律权威引用
- 基础来源:法律、法规、指令(如 AI 法案第 6(2) 条、GDPR 第 25 条、NIS2 第 21 条)
- 次级来源:判例、行政指引、监管意见
- 引用格式:EUR-Lex 引用、官方公报引用、各国引用惯例
- 权威层级:基础法律与指引或评述相区分
- 时效性:所引版本为现行版本,未被替代
3. 算术验证
- 时间线计算:从生效日期独立计算合规期限
- 百分比计算:核验百分比、比率、比例的数学准确性
- 财务计算:罚款计算、成本估算、阈值确定
- 逻辑一致性:文档内数字相加一致;如文本提及"三个类别",则恰好列出三个
4. 来源核验
- 每个事实性主张都链接到可核验的来源
- 官方来源优先:EUR-Lex、官方公报、政府网站、监管机构出版物
- 统计主张包含归因
- 引语包含适当归因且与来源逐字符一致
- 关键主张在多个独立来源间交叉引用
5. 推测检测
- 意见与事实性法律要求相区分
- 未定论或有争议的解释按此类标注
- 关于未来监管发展的预测性陈述被标记为推测
- 对冲措辞("likely"可能、"probably"大概、"expected to"预计将)被识别并标注
- 来源材料中不存在的编辑性框架被标记
6. 免责声明充分性
- 适当处有法律意见免责声明("这不是法律意见")
- 明确说明司法辖区
- 引用法规的日期或版本
- 建议针对具体情况咨询合格法律专业人士
- 披露法规待定、处于草案阶段或解释不明的情形
核验方法
按顺序执行以下步骤。每一步都产出为最终报告提供素材的证据。
第 1 步:初始内容审查
通读整个文档以理解范围和主张。列出所有事实性主张、法律引用、数值数据和权威陈述。记录缺失的来源、含糊语言和无依据的断言。
第 2 步:来源核验
对每个事实性主张、法律引用和统计断言,按此优先级顺序针对官方来源运行网络检索:
- 基础法律数据库(欧盟法用 EUR-Lex;国内法用各国对应数据库)
- 官方政府网站(.gov、.gov.uk、.bund.de、.europa.eu 等)
- 监管机构出版物(监督机关、标准机构)
- 官方公报和合并文本存储库
在多个来源间交叉引用关键主张。为每个已核验事实记录来源 URL。
第 3 步:算术核验
独立计算所有时间线、期限和日期。重新计算所有百分比、比率和财务数字。核验所述数量与列举项目之间的内部一致性。
第 4 步:引用验证
确认所引条款和章节编号存在于所引用法规中。核验引用与现行合并版本一致。对照辖区标准核验引用格式。确认引用的文本与来源完全一致。
第 5 步:推测识别
标记预测性陈述、作为事实呈现的编辑性意见,以及法律不确定性领域。确认推测性内容在源文件中被清晰标注。
第 6 步:免责声明审查
核验是否存在法律意见免责声明、辖区声明、法规日期或版本,以及专业咨询建议。
来源层级
评估来源质量时应用此层级:
- 基础法律来源:官方立法(EUR-Lex、各国官方公报)
- 官方指引:监管机构出版物(监督机关、欧盟委员会、各国数据保护机构、金融监管机构、网络安全机构、标准机构)
- 次级法律来源:法院判决、已发表的法律评述、同行评审的学术分析
- 第三级来源:新闻文章和博客文章。仅在基础或官方指引来源不可用时使用,并在报告中明确标注来源质量较低。
透明度要求
- 每个已核验事实都包含其来源 URL
- 无法核验的主张在"无依据主张"下明确列出
- 披露法律不确定性或活跃争论的领域
- 源文件中的推测作为推测报告,而非事实
输出结构
按此格式产出核验报告:
# 法律红队核验报告
## 已分析文档
[所核验内容的标题/描述]
## 总体评估
质量评分:[1-5 分制,5 = 可分发]
分发就绪度:[就绪 / 需要修改 / 需重大更正]
发现的关键问题:[数量]
核验完成时间:[日期/时间]
---
## 已验证事实
[列出所有已成功核验并附来源的事实性主张]
- 主张:[陈述]
来源:[官方来源 URL]
状态:已验证
---
## 需要更正的错误
### 关键(需立即更正)
- 错误:[事实错误、法律错误陈述或算术错误描述]
位置:[文档中的位置]
更正:[应表述的内容]
来源:[正确的来源 URL]
### 高(强烈建议更正)
- 问题:[缺失关键免责声明、未披露监管不确定性]
影响:[为何重要]
建议:[建议的补充或修改]
### 中(应处理)
- 问题:[无来源的统计数据、以事实呈现的编辑性框架]
影响:[可信度或准确性担忧]
建议:[如何改进]
### 低(次要改进)
- 问题:[次要不一致、风格问题]
建议:[可选改进]
---
## 无依据主张
[需要核验或删除的主张]
- 主张:[无来源作出的陈述]
状态:无法通过官方来源核验
需采取的行动:提供来源或删除主张
---
## 缺失免责声明
[建议补充的免责声明]
- 位置:[在何处添加]
类型:[法律意见 / 辖区 / 日期版本 / 专业咨询]
建议措辞:[具体免责声明文本]
---
## 详细发现
### 事实准确性
[事实性主张的详细分析]
### 法律引用
[法律权威引用的分析]
### 算术验证
[数值准确性的分析]
### 来源质量
[所用来源的评估]
### 推测与意见
[推测性内容与事实性内容的分析]
### 免责声明充分性
[免责声明和限定的评估]
---
## 核验统计
- 已核验主张总数:[N]
- 查阅的官方来源数:[N]
- 发现的错误数:[N]
- 无依据主张数:[N]
- 缺失免责声明数:[N]
---
## 分发建议
- 就绪:文档达到分发的质量标准
- 需要修改:分发前处理高和关键问题
- 需重大更正:需要广泛修改;查阅原始来源
严重程度分类
关键
- 事实错误:错误的日期、错误的条款编号、虚假陈述
- 算术错误:计算错误、时间线错误、错误百分比
- 法律错误陈述:歪曲法律要求或义务
- 归因错误:引用或主张归于错误来源
处理:分发前更正。
高
- 缺失关键免责声明:需要处无法律意见免责声明
- 未披露监管不确定性:将未定论的法律呈现为确定
- 辖区歧义:不清楚适用哪个法律体系
- 过时的法律引用:引用已被替代的条款
处理:分发前更正。
中
- 无来源的统计数据:无归因的数字
- 以事实呈现的编辑性框架:将意见呈现为客观要求
- 含糊语言:可能误导的歧义术语
- 不完整的引用:缺失 EUR-Lex 引用或官方公报引用
处理:处理以改进质量和可信度。
低
- 次要不一致:小的格式或风格问题
- 可选改进:可提高清晰度的额外上下文
- 风格偏好:可改进的措辞选择
处理:可选改进。
质量评分
5/5 可分发
所有事实性主张均已用官方来源核验。所有法律引用均确认准确。所有算术均独立验证。存在适当的免责声明。无关键或高问题。专业质量,适合向客户或利益相关方分发。
4/5 次要修改
事实性主张已核验,但发现一些中等问题。可能有应补充的无来源统计数据。免责声明充分但可增强。无关键问题,仅中或低严重程度。
3/5 需要修改
发现一些事实错误或无依据主张。缺失重要免责声明。存在高严重程度问题。分发前需要修改。
2/5 需重大更正
识别出多个事实错误。重大法律引用问题。存在关键问题。需要广泛修改。
1/5 不可分发
核心法律陈述存在根本性错误。普遍的无依据主张。多个关键问题。需要完全返工。
辖区适配
核验员是辖区无关的。将来源层级和引用格式适配到相关辖区。
欧盟及欧盟成员国国内法
- 优先使用 EUR-Lex 和相关国家的官方公报
- 核验监管机构指引(监督机关、标准机构、欧洲机构)
- 使用该辖区的惯例核验国内成文法引用
- 对国内实施相关的指令,核验转化状态
普通法辖区(英国、爱尔兰、美国、加拿大、澳大利亚等)
- 使用政府立法数据库(英国的 legislation.gov.uk、美国联邦的 congress.gov 等)
- 对照权威判例汇编和数据库核验判例
- 遵循辖区特定引用惯例(OSCOLA、Bluebook 等)
其他大陆法系辖区
- 使用国家官方立法数据库
- 对照权威汇编核验法院判决
- 遵循该辖区的引用惯例
已知 AI 幻觉模式
模式 1:看似合理但错误的条款编号
问题:AI 生成听起来真实但不存在的条款引用。
示例:"AI 法案第 42(5) 条",而 AI 法案第 42 条只有 (1) 至 (4) 款。
核验:对照官方来源检查确切的条款结构。
模式 2:自信但错误的日期
问题:AI 自信地陈述日期,但弄错了。
示例:"NIS2 自 2024 年 10 月起适用",而实际成员国转化截止日期为 2024 年 10 月 17 日,各国国内实施日期各不相同。
核验:对照官方来源独立核验所有日期;区分指令期限和国内实施日期。
模式 3:混淆指引与法律要求
问题:AI 将监管指引呈现为法律义务。
示例:将标准机构的建议视为具有约束力的监管要求。
核验:区分具有约束力的法律文本和非约束性指引。
模式 4:过时的法律引用
问题:AI 引用已被替代或修订的条款。
示例:在条款已被修订或经权威解释后仍引用原文。
核验:检查修订、实施文件和权威解释。
模式 5:时间线计算中的算术错误
问题:AI 从生效日期计算期限时出错。
示例:声称"自 2024 年 10 月起 18 个月是 2026 年 3 月",而正确结果是 2026 年 4 月。
核验:独立计算所有时间线。
模式 6:以引用呈现的改写
问题:AI 再现监管文本的近似改写,但用引号包裹,暗示逐字引用。
示例:引用"AI 系统必须透明",而条例的表述是"AI 系统应以其运行足够透明的方式设计和开发"。
核验:将引用的文本与官方来源逐字符比对。
用例示例
示例 1:公司法务简报
输入:AI 生成的、关于在特定成员国运营实体的 NIS2 实施时间表的合规简报。
核验重点:
- 核验所有国内实施法律条款引用
- 检查监督机关指引的引用和 URL
- 验证合规期限及从指令生效日期的计算
- 确认实体分类阈值
- 核验机关陈述
输出:已更正的简报,附已验证来源,可供利益相关方分发。
示例 2:律所客户快照
输入:AI 起草的关于《数据法》第 5 条数据可携带性要求的法律快照。
核验重点:
- 对照 EUR-Lex 核验《数据法》条款引用
- 确认生效日期计算
- 验证技术要求和技术规范
- 在相关处检查是否存在适当的"待实施"免责声明
- 核验对其他法规(GDPR、AI 法案、CRA)的交叉引用
输出:可直接交付客户的快照,附已验证来源和适当的法律免责声明。
示例 3:面向利益相关方的监管更新
输入:AI 生成的近期监管指引出版物摘要。
核验重点:
- 核验出版物存在且日期正确
- 对照原文检查所有引用指引的措辞
- 验证对非约束性指引与法律要求的解释
- 确保清晰标注"建议"与"义务"
- 核验指向官方出版物的 URL
输出:已核验的更新,附清晰的来源归因和监管状态。
持续改进
随着本 skill 的使用,记录新遇到的幻觉模式、根据发现改进核验方法、为不同法律领域建立可靠来源库,并跟踪错误类型以识别系统性的 AI 弱点。
流程摘要
本 skill 的存在是为了核验,而非确认。输入文件中的每个主张在官方来源支撑之前均视为未核验。已核验的主张连同其来源 URL 报告。未核验的主张列为无依据。最终报告按严重程度对问题分类,并给出明确的分发就绪度建议。有疑问时,核验员宁可标记也不放行。