| name | mrd-review |
| description | MRD 评审 / 价值评审 / 该不该做触发。判断市场窗口 + UE 模型,输出投票表 + 评审意见。已有报告迭代修改直接编辑 deliverables/mrd-review-*.md,不走此 skill。
|
| argument-hint | MRD 文件路径 或 Confluence/wiki 链接 [-p 项目名] |
| type | standalone |
| output_format | .md |
| output_prefix | mrd-review- |
| depends_on | [] |
| optional_inputs | ["baseline"] |
| consumed_by | [] |
| scripts | {"check_mrd.sh":"评审报告基本卫生自检(圈数字 / 占位符 / CJK 标点)— bash .claude/skills/mrd-review/scripts/check_mrd.sh <评审报告.md>","scripts/fetch_confluence.py":"拉 wiki MRD(共享脚本,根目录 scripts/)— python3 scripts/fetch_confluence.py <url> -p {项目}","scripts/check_cjk_punct.py":"CJK 半角标点扫描(共享脚本),由 check_mrd.sh 内部调用"} |
MRD 评审 Skill(MRD Review)
触发与定位
独立产出物,不在主 pipeline 上。接收一份待评审的 MRD(市场需求文档),输出该不该做的判断 + 投票表 + 评审意见,给评审会和老板决策用。
评的是价值,不是格式。MRD 模板填齐 ≠ 这个机会值得做。MRD 排版乱 ≠ 这个机会不值得做。评审者要替决策者问的是「这个事该不该做、能不能做成、做完是不是有用」。
评审任务不是给 MRD 打文档完整度分,而是替老板问八件事:
- 市场窗口是真的吗、是不是过期或者还没到
- 用户为什么要切到我方(vs 现在用的东西)
- 差异化是真的还是包装术
- 单位经济模型算得通吗、规模化后利润率怎样
- 团队 / 资金 / 时间撑得住吗、依赖项拿得到吗
- 最坏结果是什么、合规雷区有没有
- 这事和主线相关还是机会主义、挤压了什么
- 什么数据出来继续做、什么数据出来杀掉
输出对每件事给立场(成立 / 有保留 / 不成立),不是「文档写没写」。
不做:MRD 迭代修改(已有 deliverables/mrd-review-*.md 直接 Edit 即可,不走此 skill)。
改脚本前 30 秒
hook pre-skill-load-gate 守的是「Read 过本文件」不看读了多少行。
改本 skill scripts/check_mrd.sh:Read 此文件 limit=80 即可。
改评审报告产物:建议全文 Read(八维度 / 评分卡 / 找漏规则散在各章)。
Public API(不可改签名):
bash check_mrd.sh <评审报告.md> — 报告卫生自检入口;Step 6 调用
scripts/fetch_confluence.py <url> -p <项目> — wiki MRD 拉取(共享脚本,根目录 scripts/)
scripts/check_cjk_punct.py — CJK 标点扫,被 check_mrd.sh 内部调用
会拦你的 hook:
post-script-syntax-check — bash -n(写 .sh 自动跑)
post-plain-language-check — 报告 .md 写完自动扫违规口径
改完跑啥:
bash .claude/skills/mrd-review/scripts/check_mrd.sh <一份现有评审报告>
深入读什么:
- 八维度评审 + 立场标准:
grep -A 30 "^### 八维度价值评审" SKILL.md
- 定量评分细则:
references/mrd-scoring-standard.md
- 输出模板:
references/mrd-review-template.md
硬规则(FAIL 即拦)
反 PM 偷懒五问(每份评审必穿透问,不是看文档写没写,是看判断成不成立):
- 「这是真需求还是 PM 想象的需求」——引用了几个真实用户场景?有没有访谈 / 数据 / 对话原文?还是全靠「行业普遍认为」?
- 「为什么用户要从现在的解法切过来」——用户现在用什么解决(Binance / Excel / Discord / 不解决)?切换我方的理由 + 切换成本是多少?
- 「竞品不做是因为不会做还是看不上」——头部竞品没做最常见原因是 ROI 不够。「看不上」我方为什么做得起来?「不会做」我方凭什么会做?
- 「UE 算不算得通」——LTV / CAC / 毛利 / 回本周期任一没算清楚 = 赌博。规模化后利润率上升还是下降?
- 「最坏结果是什么」——失败时损失多少(钱 / 团队 / 时机),合规风险触发会怎样,能不能止损退出。只描述上行没描述下行 = 失败
反凭印象评审铁律(强制):
LLM 训练数据是参考印象不是事实。具体竞品名 / 行业基准数字 / 法律先例 / 监管动态——禁止凭训练数据印象写,必须 WebSearch 实时核实,并在报告里附 source URL。
- 写「Bybit 有 X 活动」前 → WebSearch 核实活动是否存在 + 规模
- 写「行业 CAC 在 X-Y 美金区间」前 → WebSearch 取近 12 个月公开行业报告
- 写「Coinbase Suski 案先例」前 → WebSearch 取案件 / 执法实例 URL
- 写「Bitget 投了 X 万美金」前 → WebSearch 核实金额 + 具体计划名
核实失败处理:
- WebSearch 找不到 → 删掉,不要凭印象保留
- 找到但和印象不符 → 用真实数据,撤回印象判断
- 部分找到 → 标
[据公开报道,未核实细节] + 现有 URL
关键计算必须显式列等式(防「87 当成 12」算术 bug):
- CAC / ROI / LTV 必列「分子 / 分母 = 结果 + 单位」(U / USD / RMB)
- 多口径并存时列对照表,不能只给一个数
FAIL 校验项(违任一视为未交付):
- 评审结论只夸不质疑 = FAIL(一份 MRD 不可能没漏)
- 没穿透「为什么用户要切过来」 = FAIL
- 没拷问 UE 模型 = FAIL
- 没识别合规风险(金融业务必查)= FAIL
- 没给 Go / No-Go 数据阈值 = FAIL
- 只挑文档格式毛病不评判商业价值 = FAIL
- 具体竞品名 / 行业基准数字 / 法律先例没附 source URL = FAIL(凭印象=幻觉风险)
- 关键计算(CAC / ROI / LTV)未列等式 = FAIL(隐藏算术错误)
核心输出规范
八维度价值评审 Checklist
每个维度问的是「这个判断成不成立」,不是「文档写没写」。
| # | 维度 | 评审问题(替决策者问) | 立场判定 |
|---|
| 1 | 市场窗口真伪 | 市场机会真的存在吗?时间窗口对吗(过早 / 正好 / 过晚)?支撑数据可信吗? | 成立 / 有保留 / 不成立 |
| 2 | 用户价值兑现 | 用户为什么要从现在的解法切过来?切换成本能否被新价值覆盖?真痛点还是 nice-to-have? | 成立 / 有保留 / 不成立 |
| 3 | 差异化站不站得住 | vs 头部竞品的差异是真的还是包装?竞品没做是不会做还是看不上?我方有什么独特能力? | 成立 / 有保留 / 不成立 |
| 4 | UE 模型成立性 | LTV / CAC / 毛利 / 回本周期算清没?规模化后利润率上升还是下降?依赖什么前提才成立? | 成立 / 有保留 / 不成立 |
| 5 | 资源可行性 | 团队 / 技术 / 资金 / 时间撑得住吗?关键依赖项(牌照 / 技术合作 / 流量入口)拿不拿得到? | 成立 / 有保留 / 不成立 |
| 6 | 风险底线 | 最坏结果是什么?合规雷区识别全了吗?失败时止损成本多少?有没有 Plan B? | 成立 / 有保留 / 不成立 |
| 7 | 战略契合 | 和公司主线相关还是机会主义?资源占用挤压了什么?是「应该做」还是「能做」? | 成立 / 有保留 / 不成立 |
| 8 | 成功 / 杀死标准 | 北极星指标 + 一级指标有没有?验证周期多长?什么数据 Go、什么数据 No-Go? | 成立 / 有保留 / 不成立 |
立场判定标准:
- ✅ 成立——判断有数据 / 逻辑 / 证据支撑,可经受质疑
- ⚠️ 有保留——方向对但论证不足,需要补 / 改 / 论证后才能拍板
- ❌ 不成立——有硬伤(数据来源不可信 / 逻辑跳步 / 关键风险没识别 / UE 不闭环),必须重做该维度
最终立场(报告开头一句话):
- 该做——八维度全 ✅,或最多 1-2 个 ⚠️ 且不在 1/4/6 维度
- 有保留地做——多个 ⚠️ 但无 ❌,或单个 ❌ 在 7/8 维度(战略 / 指标可后补)
- 暂不该做 / 重做——任一 ❌ 出现在 1/2/4/6 维度(市场 / 价值 / UE / 风险底线),或 ⚠️ 数 ≥ 4
产物形态 + 命名
- 格式:Markdown(Claude Design 系美学,便于贴 wiki / 飞书 / 钉钉)
- 命名:
mrd-review-{slug}-v{N}.md
- 存放:
projects/{项目}/deliverables/,无项目时 references/mrd-reviews/
- 美学:禁圈数字(
①②③)、禁裸编号(决策 N)、禁 emoji 装饰标题、CJK 旁全角标点
章节结构(按模板生成)
- 最终立场(一句话)+ 一句话理由
- 投票表(8 行 × 4 列:维度 / 立场 / 关键判断 / 修改建议)
- 定量评分卡(基础项 70 + 加分项 30 + 综合评级 + 阻塞项 + 无用功能清单)
- 评审会议程(Top 3 必须拍板 + Top 3 待讨论 + Go/No-Go 阈值)
- 八维度详细评审意见
- 找漏 & 必须补的判断(阻塞项从评分卡同步汇入)
- 反 PM 偷懒五问
- Sources + 评审局限声明
执行步骤
Outcome 评估 / 北极星判断 → Read .claude/runbooks/pm-methodology.md §三 Outcome over Output。
Step 1:输入分流 + 项目定位
判断输入类型,自动分流:
| 输入形态 | 处理方式 |
|---|
本地 .md / .docx 文件路径 | 走 Step 1.5 派 Haiku 子 agent 提取(不要主线程 Read 全文) |
https://*.atlassian.net/* 或 https://confluence.* | python3 scripts/fetch_confluence.py <url> -p {项目} 拉到 projects/{项目}/inputs/mrd-{slug}.md 后走 Step 1.5 |
| 用户只丢标题 / 模糊描述 | 反问要文件路径或 wiki 链接,不要凭空评审 |
如能识别项目,同步读 projects/{项目}/prd-{项目}-baseline.md 业务对象 / 全局规则章(产品现状 + 业务规则),交叉核对 MRD 中的判断是否和已有现状冲突。
Step 1.5:派 Haiku 子 agent 跑 MRD 提取(强制)
不要在主线程直接 Read 整份 MRD——5K+ token 全文挤主 context、20+ 章 MRD 直接溢出。MRD 提取属于 CLAUDE.md「子 Agent 调度」必派场景(结构化数据批量提取,主线程不需要原始过程)。
派 general-purpose subagent,prompt:
「读 {MRD 路径},按八维度归类提取关键段落 + 表格 + 行号,
写入 projects/{项目}/inputs/mrd-extract-{slug}.md。
维度:1 市场窗口 / 2 用户价值 / 3 差异化 / 4 UE 模型 / 5 资源 / 6 风险 / 7 战略 / 8 成功标准。
每维度只摘和该维度直接相关的原文 + 行号,不做任何评审/判断。
末尾加『MRD 核心论点一句话』+『关键数据点列表(数字 + 出处行号)』+『MRD 没明显提到的维度』。
≤ 800 字。」
主线程只读 inputs/mrd-extract-{slug}.md(800 字内),原始 MRD docx/md 不进主 context。
例外:MRD < 200 段且 < 10 个表格,主线程直接 Read 也行(临界值,可以不派但派了更稳)。
Step 2:通读 extract + 标记关键判断点
读 Step 1.5 的 extract,内部记下:
- MRD 核心论点(extract 已给)
- 八维度各自对应到 MRD 哪些段落(extract 已给行号区间)
- MRD 引用的关键数据 / 假设 / 推论(用于后续质疑 + Step 2.5 校核)
- MRD 没说的事(extract 末尾已列)
Step 2.5:外部数据校核(强制 WebSearch)
进入八维度评审前,必须用 WebSearch 把 MRD 引用的关键外部数据 + 评审者要拿来质疑 MRD 的「行业基准 / 竞品对照 / 法律先例」全部核实。
| 校核类别 | WebSearch 查询模板 | 用途 |
|---|
| MRD 引用的市场规模数字 | {细分赛道} market size 2025 | 核实 TAM / SAM 是否合理 |
| MRD 引用的行业基准 | {行业} CAC LTV benchmark 2025 | 给 UE 模型外部锚点 |
| 评审用的同类竞品 | {竞品名} {功能模块} 2025 | 防止「Bybit Angels 不存在」这种幻觉 |
| 合规风险(金融业务必查) | {业务模式} legal compliance jurisdiction | 拿到法律框架 + 案例先例 + 执法实例 |
| 监管动态(金融业务必查) | {监管机构} {业务模式} 2025 enforcement | 找近期 cease-and-desist / 起诉先例 |
并行调 4-6 个 WebSearch(独立查询,无依赖),结果直接进 Step 3。
判定:找到真实数据 → 用真实数据 + URL;找不到 → 不写;部分找到 → 标 [据公开报道,未核实] + URL。
Step 3:八维度价值评审(核心步骤)
逐维度按 §核心输出规范 checklist 穿透问,给立场。
每个 ⚠️ / ❌ 必须给三件套:
- 原文位置: MRD 第 X 章 / line 23-28
- 评审意见: 「TAM 50 亿美金的估算建立在『中国持币人口 2000 万 × 客单价 250 美金』,但 2000 万这个数被多家行业报告引用过、原始来源是 2021 年某交易所自报数据,三年过去没更新;按链上活跃地址回推,真实持仓 ≥ $100 用户大概 400-600 万。SAM 至少打 2 折。」
- 修改建议: 「重做市场规模测算,建议链上口径(活跃地址 + 持仓阈值)+ 行业第三方口径(Messari / a16z)双交叉,不接受单一交易所自报数据。」
每个 ✅ 也写一句话为什么成立,不能光打钩。
Step 3.5:定量评分(强制)
走完八维度定性后,按 references/mrd-scoring-standard.md 逐项打分:
- 基础项(B-1~B-7,共 70 分):按子维度给分,扣分写理由
- 加分项(P-1~P-3,共 30 分):有则给分,缺失给 0
- 阻塞项识别:任一基础项 ≤ 2 分 / B-6 无 Go/No-Go 机制 / 发现无用功能未说明 → 标 🔴
- 综合评级:88+ 优秀 / 72-87 良好 / 55-71 基础达标 / 38-54 不合格 / < 38 重做
- 无用功能清单:方案中无法关联到任何用户痛点或问题现状的功能动作 → 列入 + 处置建议
B-7 经济模型触发条件(满足任一即必填):含任务奖励 / 活动奖励等直接成本 / 涉及推广费用 / KOL 预算 / 跨部门协调 > 20 人/日。不涉及以上情形本项满分。
评分卡写入输出模板第 2 章,阻塞项同步汇入找漏章节(第 5 章)。
Step 4:穿透五问 + 找漏
走完八维度后,强制再过一遍 §硬规则 反 PM 偷懒五问,每条给一段评审意见。这一步是为了找 MRD 没写的事——常见漏项:
- 没写「用户现在用什么解决这个问题」
- 没写「竞品没做的真实原因」(多半 ROI 不够)
- 没算 UE 或只算了 LTV 没算 CAC
- 没识别合规风险(金融业务死穴)
- 没给 No-Go 阈值(只说「成功就继续」=没说杀死标准)
- 没说失败时的止损路径
找到的漏项放「找漏 & 必须补的判断」章节,每条标重要级(🔴 必补 / 🟡 应补 / 🟢 可补)。
Step 5:产出投票表 + 详细评审报告
按 references/mrd-review-template.md 结构生成 projects/{项目}/deliverables/mrd-review-{slug}-v{N}.md。章节同 §核心输出规范。无项目归属时存 references/mrd-reviews/mrd-review-{slug}-v{N}.md。
Step 6:自检 + 交付
bash .claude/skills/mrd-review/scripts/check_mrd.sh <评审报告.md>
通过后把投票表 + 最终立场(前半部分)粘对话回复给用户,提示评审报告完整版已存到 deliverables/。
References 索引
必读(产出前加载):
references/mrd-review-template.md — 投票表 + 定量评分卡 + 详细评审报告输出结构
references/mrd-scoring-standard.md — 100 分制定量评分标准(B-1B-7 + P-1P-3 + 阻塞项 + 综合评级)
按需读:
- 项目
prd-{项目}-baseline.md — MRD 关联具体项目时读,交叉核对术语 / 业务规则 / 已有判断
- 行业基准数据(用户给 / WebSearch 取)— MRD 引用市场数据时核对真伪
执行类(模型不读,脚本调用):
scripts/check_mrd.sh — 报告卫生自检
scripts/fetch_confluence.py(共享脚本)— wiki MRD 拉取
自检清单