원클릭으로
experiment-orchestrator
当需要设计或执行A/B测试实验时使用。实验验证指挥官,调度experiment-design/execution。关键词:A/B测试、实验设计、统计显著性、实验执行、效果验证、AB测试、对照实验。
Codex 또는 Claude로 설치 이 Prompt를 복사해 Codex, Claude 또는 다른 어시스턴트에 붙여 넣으면 Skill 페이지를 검토하고 설치를 진행할 수 있습니다.
메뉴
当需要设计或执行A/B测试实验时使用。实验验证指挥官,调度experiment-design/execution。关键词:A/B测试、实验设计、统计显著性、实验执行、效果验证、AB测试、对照实验。
Codex 또는 Claude로 설치 이 Prompt를 복사해 Codex, Claude 또는 다른 어시스턴트에 붙여 넣으면 Skill 페이지를 검토하고 설치를 진행할 수 있습니다.
SOC 직업 분류 기준
当需要执行完整的需求分析流程时使用。需求洞察指挥官,调度insight-analysis完成JTBD、需求分层、5Whys、KANO分类和优先级评分。关键词:需求分析流程、需求洞察编排、需求优先级全流程、JTBD、5Whys、KANO、优先级评分、分析需求、挖掘需求、用户需求、需求排序。本编排器为透传编排器,仅调度1个子Skill(insight-analysis),上层编排器也可直接调用insight-analysis。
当需要执行完整的市场与竞品分析流程时使用。市场竞品指挥官,调度market-tam-som/pest/competitor-analysis。关键词:市场分析、竞品分析、TAM/SAM/SOM、PEST、竞品情报、四象限、市场规模、行业分析、竞争对手、竞品调研。
当需要执行完整的机会识别与定义流程时使用。机会识别指挥官,调度opportunity-definition完成机会评分、问题陈述、HMW发散和机会简报。关键词:机会识别、机会评分、HMW、Problem Statement、Opportunity Brief、产品机会、机会评估、问题定义。
当需要执行完整的用户研究流程时使用。用户研究指挥官,调度voice-analysis/behavior-analysis/user-modeling/interview-assist/report。关键词:用户研究、VOC分析、行为分析、Persona、访谈辅助、用户调研、用户画像、用户反馈、用户访谈。
当需要设计或评估产品商业模式时使用。商业模式指挥官,调度business-model-canvas/value-fit/pricing/strategy-report。关键词:商业模式、商业画布、定价策略、商业战略报告、怎么赚钱、盈利模式、收费模式、商业评估。
当需要进行产品立项、战略规划或路线图制定时使用。战略规划指挥官,调度产品提案、战略分析(SWOT/Ansoff/波特五力)、OKR、北极星、路线图等子Skill。关键词:产品立项、战略规划、SWOT、OKR、路线图、战略分析、制定目标、产品规划、年度规划。
| name | experiment-orchestrator |
| description | 当需要设计或执行A/B测试实验时使用。实验验证指挥官,调度experiment-design/execution。关键词:A/B测试、实验设计、统计显著性、实验执行、效果验证、AB测试、对照实验。 |
| metadata | {"module":"产品度量运营","sub-module":"实验验证","type":"orchestrator","version":"8.0","domain_tags":["通用"],"trigger_examples":["设计一个A/B测试","验证一下方案效果","跑一下对照实验","分析实验结果"]} |
实验是学习的最快方式
每一个实验都是一次有控制的探索,目标不是证明假设正确,而是以最快速度获得可靠的学习。实验的价值在于学习速度,而非实验数量。
编排协议遵循 orchestrator-protocol.md 统一标准。
pipeline: experiment-orchestrator
version: 8.0
post_pipeline:
- action: stage-summary
output: output/phase-reports/pm-metrics-ops/experiment-orchestrator.md
stages:
- id: phase-1
name: "实验设计"
depends_on: []
skills: [experiment-design]
gate:
condition: "实验设计经人类审核确认"
fail_action: "阻止实验上线,修改后重新审核"
- id: phase-2
name: "实验执行"
depends_on: [phase-1]
skills: [experiment-execution]
gate:
condition: "样本量充足且统计检验完成、实验报告经人类审核确认"
fail_action: "延长实验周期或扩大流量"
Skill: experiment-design
输入:
hypothesis: 用户提供(假设陈述)
available_traffic: 用户提供(可用流量)
metrics_system: metrics-system → metrics.json(可选)
historical_data: analysis-funnel/analysis-retention(可选)
输出: output/pm-metrics-ops/experiment-design/
验证: 假设已结构化(If-Then-Because-For);主指标与假设直接对应;护栏指标覆盖留存、收入、技术三个维度;样本量计算参数有据可依
模式: 🤖→👤
Skill: experiment-execution
输入:
experiment_design: output/pm-metrics-ops/experiment-design/experiment_design.json
experiment_data: 用户提供
termination_conditions: output/pm-metrics-ops/experiment-design/experiment_design.json
product_background: 用户提供(可选)
输出: output/pm-metrics-ops/experiment-execution/
验证: 实验分组流量分配正确;护栏指标未触发告警;实验数据采集完整;统计显著性计算正确;统计结论与数据一致;行动建议与结论一致;护栏指标全覆盖;异质性效应已分析(至少3个分群维度)
模式: 🤖→👤
所有业务阶段执行完成后,必须立即生成阶段总结文档:
动作: 生成阶段总结
输入:
所有子Skill输出: output/pm-metrics-ops/
人类决策记录: 本轮执行中的人类决策点及结果
输出: output/phase-reports/pm-metrics-ops/experiment-orchestrator.md
验证: 阶段总结文档已生成,6项结构(执行概览/关键发现/决策记录/产出清单/风险与待办/下游衔接)均非空
下游衔接:
primary:
target: decision-orchestrator
reason: 实验完成,将实验结论转化为决策行动
input_mapping:
experiment_output: "output/pm-metrics-ops/experiment-execution/ → decision-dace输入"
alternatives:
- target: release-orchestrator
reason: 实验结果显著,建议全量发布
condition: 实验结果统计显著(p<0.05)且业务意义达标时
- target: analysis-orchestrator
reason: 实验结果需更深入的数据分析
condition: 实验结果存在异常或需多维下钻时
special_cases: []
模式: 🤖
⏸ 阶段卡口:阶段总结文档已生成且6项结构均非空 → 未通过:补充缺失结构项后重新生成
| 卡口 | 条件 | 未通过处理 |
|---|---|---|
| 实验方案人类已审核 | 实验设计经人类审核确认 | 阻止实验上线,修改后重新审核 |
| 统计显著性已判断 | experiment-result输出文件已生成且非空 | 延长实验周期或扩大流量 |
| 实验报告已审核 | 实验报告经人类审核确认 | 补充分析或修改结论 |
| 阶段总结已生成 | output/phase-reports/pm-metrics-ops/experiment-orchestrator.md 已生成且6项结构均非空 | 补充缺失结构项后重新生成 |
| 决策点 | 触发条件 | 决策内容 |
|---|---|---|
| 实验方案审核 | 实验设计完成 | 审核假设合理性、指标选择、分流方案 |
| 全量/终止决策 | 实验结果分析完成 | 决定全量发布、终止实验或延长周期 |
| 实验报告确认 | 实验报告生成完成 | 确认报告结论和行动建议 |
| 条件 | Action |
|---|---|
| 样本量达到100% | 立即触发结果分析 |
| 统计显著(p < 0.05)且稳定 | 考虑提前终止 |
| 护栏指标显著下降 | 触发告警,考虑终止 |
| 新奇效应显著 | 延长实验周期 |
| 实验组持续负向 | 考虑提前终止 |
| 异常类型 | 处理策略 |
|---|---|
| 实验设计人类审核未通过 | 阻止实验上线,返回设计阶段修改,不进入执行阶段 |
| 护栏指标突破阈值 | 立即暂停实验执行,触发告警,提交人类决策是否终止实验 |
| 实验数据采集异常 | 标记数据异常,暂停统计检验,提示人类检查数据管道 |
| 实验报告人类审核未通过 | 返回执行阶段补充分析,不传递到下游 |
| 多实验流量冲突 | 按优先级排队,低优先级实验暂停,标注"流量冲突" |
| 阶段总结生成失败 | 基于已完成的子Skill输出生成部分总结,缺失项标注"数据缺失",不阻塞编排完成 |