一键导入
benchmark-ab-runner
Compare baseline and candidate query performance metrics and declare a benchmark winner.
用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
菜单
Compare baseline and candidate query performance metrics and declare a benchmark winner.
用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
基于 SOC 职业分类
Designs dry-run experiments across query rewrites, indexes, workload twins, and rollout gates.
Produces a board-level briefing for closed-loop autonomous database operations.
Enforces closed-loop dry-run boundaries and blocks autonomous production apply.
Scores whether enough evidence exists to recommend, defer, or escalate an autonomous operator decision.
Compares do-nothing, dry-run-change, rollback, and defer scenarios for an operating objective.
Builds an executive-grade decision evidence packet from runtime signals and confidence checks.
| name | benchmark-ab-runner |
| description | Compare baseline and candidate query performance metrics and declare a benchmark winner. |
Run:
node runtime/runTool.js benchmark_ab_runner '{"baseline":{"p95Ms":300,"cpuMs":80},"candidate":{"p95Ms":190,"cpuMs":55}}'
Returns deltas, winner, and verdict.