| name | auto-test-run |
| description | 完成代码、测试、配置、文档或 agent 改动后主动使用。根据 DicePP 改动风险选择最小可信验证范围,执行 pytest、dicepp-shell 或其他必要检查,并向用户汇报已运行、未运行和失败项;不得默认调用真实 LLM、外部 API、付费服务或高成本 e2e。 |
Auto Test Run
使用本技能决定“这次应该怎么验证”,而不是机械跑全量测试。
验证选择
- 局部代码改动:优先运行直接相关的测试文件、测试目录或最小 pytest 选择器。
- 共享逻辑、核心框架、数据层、迁移、配置或测试基础设施改动:扩大到相关模块测试,必要时运行全量默认 pytest。
- 用户可见的机器人指令行为:配合
dicepp-shell 做交互验收,优先验证真实输入输出。
- 纯文档或 agent skill/rule 改动:运行对应格式、同步或脚本检查;不必为了形式跑业务测试。
- 修 bug:至少运行能覆盖该 bug 的回归测试;没有合适测试时说明原因,并考虑是否需要补测。
常用入口
项目 pytest 默认配置已排除 real_llm:
uv run pytest
按范围验证时使用更窄目标:
uv run pytest tests/path_or_file.py
uv run pytest tests/some_module/
涉及真实 LLM、外部 API、付费服务、慢速 e2e 或生产数据前,先向用户确认范围、成本和风险。
汇报格式
最终汇报验证时简洁列出:
- 已运行:命令或验证方式
- 结果:通过 / 失败 / 未完成
- 未运行:有价值但本次未跑的验证及原因
- 后续:失败项、风险或建议
边界
- 不默认生成测试报告文件。
- 不把覆盖率作为唯一目标;优先验证行为契约和风险面。
- 测试设计质量由
auto-test-guard 约束;本技能负责选择并执行验证范围。