用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
直接命令不会经过审查 Prompt;运行前请先检查来源。
npx skills add https://github.com/zhaoxuya520/AI-Fullstack-Delivery-Workflow --skill test-report命令会保持在同一行。复制前请横向滚动并检查完整内容。
想先保存到本地?可下载 SkillsMP 当前能够提供的文件。
正在显示 SKILL.md
基于 SOC 职业分类
| name | test-report |
| description | 输出测试结论 / 给上线决策时使用。适用于版本发布报告、阶段总结、缺陷分析。融合 ISTQB Test Summary Report、覆盖率分析、缺陷分布。 |
参考来源:ISTQB Test Summary Report (IEEE 829)、Google Test Reporting Best Practices、SonarQube Quality Reports。
1. 报告是给决策者看的
首页必须有"建议是否放行"
2. 数字 + 趋势 + 结论
不只是列数字,要给意见
3. 风险透明
"已知问题"必须明示,不藏
4. 一页纸总结 + 详细附录
忙人看一页,关心人看附录
5. 可对比
与上版本 / 基线对比
6. 数据不撒谎
覆盖率高 ≠ 质量好
覆盖率是"测试了多少",不是"测对了多少"
本次测试:[范围]
执行:[X 条用例 / Y 小时]
结论:建议放行 / 有条件放行 / 不建议放行
关键风险:[1-2 条]
- 必测:✅ 100%(X/X)
- 选测:✅ 80%(Y/Z)
- 不测:[列表 + 原因]
- 总数:X 个
- 严重度分布:S0:0 / S1:2 / S2:5 / S3:8
- 修复率:X%
- 待修:[ID 列表]
- 用例覆盖:100% 验收标准
- 代码覆盖:[%(如有)]
- 风险覆盖:C 级 100% / H 级 100% / M 级 80%
- 性能基线:✅ 达标 / ⚠️ 退化 X%
□ 必测用例 100% 通过
□ 高风险 Bug = 0
□ 性能 SLO 达标
□ 验收 UAT 通过
→ 建议:放行 / 不放行
计划用例数:
执行用例数:
通过:✅ X 条
失败:❌ Y 条
跳过:⏭️ Z 条
执行率:执行/计划
通过率:通过/(通过+失败)
新增 Bug:X 个
修复 Bug:Y 个
关闭 Bug:Z 个
未修复 Bug:W 个
- S0:0
- S1:1(已知问题)
- S2:3(已知问题)
平均修复时间(MTTR):X 小时
缺陷逃逸率(生产 / 测试):X%
验收标准覆盖:100%
代码行覆盖:80%(仅供参考)
分支覆盖:65%
风险覆盖:
- C 级:100%
- H 级:100%
- M 级:80%
- L 级:30%
P99 响应时间:[实测] vs [SLO]
QPS:[实测] vs [目标]
错误率:[实测] vs [SLO]
对比上版本:[退化 / 持平 / 改善]
按模块:
订单 ████████ 8
支付 ████ 4
用户 ██ 2
→ 重点:订单模块
按发现阶段:
单元测试 ███ 3 (修复成本:低)
集成测试 ████ 4
E2E ██ 2
探索式 █████ 5
生产 0 (好)
→ 大部分缺陷在测试期发现,符合预期
按根因:
需求理解错 ███ 3
设计缺陷 ██ 2
编码错误 █████ 5
配置错 ██ 2
数据问题 █ 1
第三方 0
→ 编码错误占大头,建议加强 code review
按严重度:
S0 ░ 0
S1 █ 1
S2 ███ 3
S3 ██████████ 10
→ 严重 Bug 少,主要是细节
本版本 vs 上版本:
| 指标 | 上版本 | 本版本 | 趋势 |
|---|---|---|---|
| Bug 总数 | 15 | 13 | ↓ |
| S0/S1 数 | 3 | 1 | ↓ |
| 修复时间 | 6h | 4h | ↓ |
| 用例数 | 120 | 145 | ↑(覆盖增强)|
| 通过率 | 95% | 98% | ↑ |
| 性能 P99 | 350ms | 380ms | ⚠️ 轻退化 |
推荐自动化项:
- 用例执行结果:CI 集成(Allure / TestRail)
- 代码覆盖率:自动收集(JaCoCo / Coverage.py)
- 性能数据:自动从压测工具拉
- Bug 趋势:从跟踪系统 API
人工撰写项:
- 风险结论
- 放行建议
- 已知问题影响分析
- 改进建议
# v1.2.3 测试报告
## 一句话结论
✅ 建议放行(或 ⚠️ 有条件放行 / ❌ 不建议放行)
## 关键数据
- 用例 145/145 通过率 98%
- Bug 13 个:S0:0 / S1:1 / S2:3 / S3:9
- 性能:达标
- UAT:通过
## 关键风险
1. 多币种汇率刷新偶发延迟(S2 已知,不阻塞)
## 已知问题(业务方已知悉)
- BUG-XXX:[简述 + 影响 + 缓解]
## 放行 Checklist
✅ 必测 100% 通过
✅ S0/S1 = 0
✅ 性能 SLO 达标
✅ UAT 通过
✅ 监控告警就绪
1. 收集数据
- 用例结果(自动)
- 缺陷数据(自动)
- 性能数据(自动)
- 覆盖率(自动)
↓
2. 分析
- 趋势对比
- 缺陷分布
- 风险评估
↓
3. 撰写报告
- 一页纸总结
- 详细附录
↓
4. 评审
- 与 PM / Tech Lead 评审结论
↓
5. 发布
- 项目群 / 邮件 / Wiki
↓
6. 决策
- 放行 / 修复 / 推迟
↓
7. 沉淀
- 经验进 field-journal
- 缺陷模式更新 pitfalls
□ 一句话结论清晰
□ 数据有上下文(对比基线)
□ 缺陷按多个维度分布
□ 风险透明(已知问题列出)
□ 放行 Checklist 明确
□ 性能数据完整(如有)
□ 改进建议具体可执行
□ 自动化数据 + 人工分析结合
□ 报告可读(图表 / 表格)
□ 决策者看 1 分钟能决定
templates/test-report-template.md — 完整测试报告(一页纸总结 + 详细附录 + 缺陷分布 + 趋势对比 + 放行 Checklist)上游:
test-strategy → 测试范围基线
test-case-design → 用例数据
bug-reporting → 缺陷数据
regression-testing → 回归结果
performance-testing → 性能数据
acceptance-testing → UAT 结论
下游:
quality-gate → 报告作为放行依据
项目经理工作流 → 进度纳入项目报告
技术文档工作流 → 已知问题进发布说明
field-journal → 经验沉淀