一键导入
auto-test-project
当用户明确要求"测试项目"、"运行 auto-test-project"或"进行项目级测试"时使用。对完整项目进行多轮 A 轮批判性测试 + B 轮质量检查,系统化发现、记录、修复问题。⚠️ 不适用:用户只是想优化功能(应直接修改)、只是询问项目问题(应直接回答)、没有明确"测试"意图。
用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
菜单
当用户明确要求"测试项目"、"运行 auto-test-project"或"进行项目级测试"时使用。对完整项目进行多轮 A 轮批判性测试 + B 轮质量检查,系统化发现、记录、修复问题。⚠️ 不适用:用户只是想优化功能(应直接修改)、只是询问项目问题(应直接回答)、没有明确"测试"意图。
用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
基于 SOC 职业分类
根据用户描述生成高质量绘图 prompt,并按通用、roadmap、schematic 模式调用 gpt-image-2 或 Nano Banana/Gemini 图片模型 API;gpt-image-2 默认使用低画质、原生尺寸和 JPEG,第 2 轮起基于上一轮图片做保真微调。
当用户明确要求"测试代码"、"运行代码审查"或"进行代码自检"时使用。通过多轮 A 轮批判性代码审查 + B 轮代码质量原则检查,系统化发现、记录、修复程序代码中的问题,并将计划/过程/结果统一沉淀到目标代码根目录的 `.bensz-api/task-{yyyymmdd-hhmm}-{简短描述}/auto-test-code/{yyyy-mm-dd-hh-mm}/output/tests/` 隔离工作区。⚠️ 不适用:用户只是想优化功能(应直接修改)、只是询问代码问题(应直接回答)、没有明确"测试代码"意图。
当用户明确要求"测试技能"、"运行 auto-test"或"进行批判性测试"时使用。通过多轮 A 轮批判性测试 + B 轮质量原则检查,系统化发现、记录、修复问题,并沉淀可追溯的 `.bensz-api/task-{yyyymmdd-hhmm}-{简短描述}/auto-test-skill/output/plans/` 与 `.bensz-api/task-{yyyymmdd-hhmm}-{简短描述}/auto-test-skill/output/tests/` 文档。⚠️ 不适用:用户只是想优化功能(应直接修改)、只是询问技能问题(应直接回答)、没有明确"测试"意图。
后端开发专家。精通 Node.js/Python/Go/Rust 等后端技术栈,专注于 API 设计、数据库优化、认证授权、微服务架构和性能调优。用于后端服务开发、API 设计和系统架构。
当用户明确要求"使用 brainstorming"或"使用 awesome-code"时使用。⚠️ 不适用:用户只是想优化/改进某个功能(应直接修改)、只是询问技能问题(应直接回答)、没有明确使用 brainstorming/awesome-code 的一般性开发。
Use when completing tasks, implementing major features, or before merging to verify work meets requirements - reviews implementation against plan or requirements with severity分级(Critical/Important/Minor). NO MERGE WITHOUT CODE REVIEW FIRST.
| name | auto-test-project |
| category | normal |
| description | 当用户明确要求"测试项目"、"运行 auto-test-project"或"进行项目级测试"时使用。对完整项目进行多轮 A 轮批判性测试 + B 轮质量检查,系统化发现、记录、修复问题。⚠️ 不适用:用户只是想优化功能(应直接修改)、只是询问项目问题(应直接回答)、没有明确"测试"意图。 |
| metadata | {"author":"Bensz Conan","short-description":"多轮 A 轮测试 + B 轮质量检查 的项目级测试驱动优化流水线","keywords":["auto-test-project","项目级测试","project QA"]} |
本 Skill 的新任务中间文件统一写入 ./.bensz-api/task-{yyyymmdd-hhmm}-{简短描述}/{skill名}/input|output|log/。同一任务复用一个任务根目录;多 Skill 协作才创建 shared/。正式交付物不写入该目录,历史隐藏目录只允许显式兼容读取、迁移或清理。
bensz-collect-bugs 规范记录到 ~/.bensz-skills/bugs/,不要直接修改用户本地已安装的 skill 源码;若有 workaround,先记 bug,再继续完成任务。gh 上传新增 bug 到 huangwb8/bensz-bugs;不要 pull / clone 整个仓库。.bensz-api/task-{yyyymmdd-hhmm}-{简短描述}/auto-test-project/output/plans/ 与 .bensz-api/task-{yyyymmdd-hhmm}-{简短描述}/auto-test-project/output/tests/):python3 auto-test-project/scripts/create_test_session.py --project-root . --kind a --create-plan
安全提示:该脚本会在 --project-root 下创建 .bensz-api/task-{yyyymmdd-hhmm}-{简短描述}/auto-test-project/output/plans/ 与 .bensz-api/task-{yyyymmdd-hhmm}-{简短描述}/auto-test-project/output/tests/。为防止误用,默认拒绝将系统根目录或用户主目录作为 project-root;如你确有需要,可显式加 --allow-unsafe-root 覆盖。
.bensz-api/task-{yyyymmdd-hhmm}-{简短描述}/auto-test-project/output/plans/vYYYYMMDDHHMM.md 写出本轮问题清单(至少 10 个),并使用可引用编号(如 P0-1)。.bensz-api/task-{yyyymmdd-hhmm}-{简短描述}/auto-test-project/output/tests/vYYYYMMDDHHMM/TEST_PLAN.md 与 .bensz-api/task-{yyyymmdd-hhmm}-{简短描述}/auto-test-project/output/tests/vYYYYMMDDHHMM/TEST_REPORT.md 的可复现证据。python3 auto-test-project/scripts/verify_test_session.py --require-plan .bensz-api/task-{yyyymmdd-hhmm}-{简短描述}/auto-test-project/output/tests/vYYYYMMDDHHMM
为完整项目(包括技能项目、工作流项目、或其他具有 CLAUDE.md 或类似指令文件的项目)提供系统性的测试驱动优化能力,通过多轮迭代实现持续改进。
本技能中的"项目"是指:
CLAUDE.md、AGENTS.md、PROJECT.md 等)init-project 定义的项目结构典型项目类型:
本 skill 的交付不是"口头建议",而是一组可追溯的文件:
.bensz-api/task-{yyyymmdd-hhmm}-{简短描述}/auto-test-project/output/plans/vYYYYMMDDHHMM.md:A 轮问题分析与改进计划(每轮 1 份).bensz-api/task-{yyyymmdd-hhmm}-{简短描述}/auto-test-project/output/tests/vYYYYMMDDHHMM/:A 轮测试会话目录(包含 TEST_PLAN.md + TEST_REPORT.md).bensz-api/task-{yyyymmdd-hhmm}-{简短描述}/auto-test-project/output/plans/B轮-vYYYYMMDDHHMM.md:B 轮质量检查报告(维度以 config.yaml:b_round_check.dimensions 为准).bensz-api/task-{yyyymmdd-hhmm}-{简短描述}/auto-test-project/output/tests/B轮-vYYYYMMDDHHMM/:B 轮验证会话目录(包含 TEST_PLAN.md + TEST_REPORT.md)vYYYYMMDDHHMM(分钟级时间戳).bensz-api/task-{yyyymmdd-hhmm}-{简短描述}/auto-test-project/output/plans/.bensz-api/task-{yyyymmdd-hhmm}-{简短描述}/auto-test-project/output/tests/B轮-用户输入(项目根目录 + 问题列表/优化目标)
↓
[项目初始化]:验证项目结构、识别项目类型
↓
[A轮 × N]:分析 → 计划 → 优化 → 轻量测试
↓
B轮:质量原则检查(以 `config.yaml:b_round_check.dimensions` 为准) → 针对性优化 → 轻量验证
↓
完成(文档齐全 + 问题闭环 + 项目 CHANGELOG.md 已更新)
目标:确认目标是一个有效的"项目",并识别项目类型。
检查项:
CLAUDE.md、AGENTS.md、PROJECT.md 等)config.yaml、package.json、pyproject.toml 等)输出:PROJECT_TYPE.md(可选,记录项目类型和关键信息)
目标:确定测试范围和优先级。
分析维度:
输出:在首个 A 轮计划中记录测试边界。
目标:创建本轮的 .bensz-api/task-{yyyymmdd-hhmm}-{简短描述}/auto-test-project/output/plans/ 与 .bensz-api/task-{yyyymmdd-hhmm}-{简短描述}/auto-test-project/output/tests/ 骨架。
推荐使用确定性脚本:
python3 auto-test-project/scripts/create_test_session.py --project-root . --kind a --id vYYYYMMDDHHMM --create-plan
# 可选:如果你希望 TEST_PLAN.md 直接以计划文档为“种子”,再手动补齐测试细节
python3 auto-test-project/scripts/create_test_session.py --project-root . --kind a --id vYYYYMMDDHHMM --seed-test-plan-from-plan
最低要求:
.bensz-api/task-{yyyymmdd-hhmm}-{简短描述}/auto-test-project/output/plans/ 与 .bensz-api/task-{yyyymmdd-hhmm}-{简短描述}/auto-test-project/output/tests/ 存在.bensz-api/task-{yyyymmdd-hhmm}-{简短描述}/auto-test-project/output/tests/vYYYYMMDDHHMM/TEST_PLAN.md 与 .bensz-api/task-{yyyymmdd-hhmm}-{简短描述}/auto-test-project/output/tests/vYYYYMMDDHHMM/TEST_REPORT.md 存在.bensz-api/task-{yyyymmdd-hhmm}-{简短描述}/auto-test-project/output/plans/)目标:把本轮要解决的问题写成可执行计划,按 P0/P1/P2 排序。
输出:.bensz-api/task-{yyyymmdd-hhmm}-{简短描述}/auto-test-project/output/plans/vYYYYMMDDHHMM.md
⭐️ 核心价值:本项目级测试的核心价值在于系统视角和批判性思维,而非替代 linter 进行表面检查。
数量要求(强制):
⚠️ 质量要求(批判性思维门槛):
说明:默认口径以 config.yaml:test_rounds.min_issues_per_round 与 config.yaml:test_rounds.target_issues_range 为准。
核心要求:
.bensz-api/task-{yyyymmdd-hhmm}-{简短描述}/auto-test-project/output/plans/ 与 .bensz-api/task-{yyyymmdd-hhmm}-{简短描述}/auto-test-project/output/tests/(避免确认偏差/路径依赖)config.yaml:a_round_check.independent_review.exclude_patterns 为准(历史产物/缓存/依赖目录应排除)详细结构模板:references/A_ROUND_PLAN_TEMPLATE.md(包含"系统视角与批判性分析"章节)
批判性思维必读:
references/CRITICAL_THINKING_GUIDE.md ⚠️ 核心文档,必须使用references/CONSTRUCTIVE_SUGGESTION_GUIDELINES.md 建设性建议标准(避免“空洞建议/不可验证”)references/ANTI_PATTERNS_LIBRARY.md 反例库(快速识别常见项目级反模式)问题挖掘技巧:references/PROJECT_ISSUE_DISCOVERY_TECHNIQUES.md
如首轮无明确问题列表:先做静态检查与一致性检查,再给出问题清单。
.bensz-api/task-{yyyymmdd-hhmm}-{简短描述}/auto-test-project/output/tests/)目标:按计划逐项修复,并用轻量测试验证。
输出:.bensz-api/task-{yyyymmdd-hhmm}-{简短描述}/auto-test-project/output/tests/vYYYYMMDDHHMM/TEST_PLAN.md 和 .bensz-api/task-{yyyymmdd-hhmm}-{简短描述}/auto-test-project/output/tests/vYYYYMMDDHHMM/TEST_REPORT.md
⚠️ 强制要求 - 防止"假计划、空报告":
禁止行为:
{{TEST_ID}}、{{MODULE_1}} 等)必须满足:
验证方法(每轮结束后必须执行):
# 检查是否还有未替换的模板占位符
grep -r "{{" .bensz-api/task-{yyyymmdd-hhmm}-{简短描述}/auto-test-project/output/tests/vYYYYMMDDHHMM/
# 如果有输出,说明模板未被正确替换,必须修复
# 使用验证脚本(推荐)
python3 auto-test-project/scripts/verify_test_session.py .bensz-api/task-{yyyymmdd-hhmm}-{简短描述}/auto-test-project/output/tests/vYYYYMMDDHHMM
# 可选:更严格模式(要求 .bensz-api/task-{yyyymmdd-hhmm}-{简短描述}/auto-test-project/output/plans/vYYYYMMDDHHMM.md 存在且包含 P0-1 等编号,才能做计划-报告一致性检查)
python3 auto-test-project/scripts/verify_test_session.py --require-plan .bensz-api/task-{yyyymmdd-hhmm}-{简短描述}/auto-test-project/output/tests/vYYYYMMDDHHMM
轻量测试原则:
.bensz-api/task-{yyyymmdd-hhmm}-{简短描述}/auto-test-project/output/tests/vYYYYMMDDHHMM/_artifacts/,不污染主目录TEST_PLAN.md 最低内容标准:
TEST_REPORT.md 最低内容标准:
⚠️ 数量验证(强制检查):
在进入下一轮之前,必须确认:
⚠️ 进入下一轮前的强制检查:
在进入下一轮 A 轮之前,必须执行以下验证:
# 1. 检查模板占位符是否被替换
python3 auto-test-project/scripts/verify_test_session.py .bensz-api/task-{yyyymmdd-hhmm}-{简短描述}/auto-test-project/output/tests/vYYYYMMDDHHMM
# 2. 检查计划与报告的一致性
# - .bensz-api/task-{yyyymmdd-hhmm}-{简短描述}/auto-test-project/output/plans/vYYYYMMDDHHMM.md 中的每个问题是否在 TEST_REPORT.md 中有对应记录
# - 成功标准是否在报告中有验证结论
验证失败的处理:
验证通过的判断标准:
进入下一轮 A 轮的典型条件:
重要:A 轮结束后(无论多少轮),必须进入 B 轮质量检查,不得跳过。
⚠️ 强制执行:B 轮质量检查是项目级自动测试流程的强制性环节,除非用户明确要求跳过,否则不得省略。
.bensz-api/task-{yyyymmdd-hhmm}-{简短描述}/auto-test-project/output/plans/)目标:对 A 轮后的最新状态做系统性质量检查。
输出:.bensz-api/task-{yyyymmdd-hhmm}-{简短描述}/auto-test-project/output/plans/B轮-vYYYYMMDDHHMM.md
建议数量与修复门槛(默认口径以 config.yaml:b_round_check.* 为准):
检查维度(以 config.yaml:b_round_check.dimensions 为准):
references/ 或 docs/模板:templates/B_ROUND_CHECK_TEMPLATE.md
.bensz-api/task-{yyyymmdd-hhmm}-{简短描述}/auto-test-project/output/tests/)目标:对 B 轮发现的 P0/P1 进行针对性修复并验证。
推荐创建独立会话目录:
建议显式提供 --a-test-id(对应 A 轮会话 ID),避免 B 轮文档中 A/B 关联被默认值误导。
python3 auto-test-project/scripts/create_test_session.py --project-root . --kind b --id vYYYYMMDDHHMM --a-test-id vYYYYMMDDHHMM
输出:.bensz-api/task-{yyyymmdd-hhmm}-{简短描述}/auto-test-project/output/tests/B轮-vYYYYMMDDHHMM/TEST_REPORT.md
config.yaml 的 b_round_check.mandatory).bensz-api/task-{yyyymmdd-hhmm}-{简短描述}/auto-test-project/output/plans/ 与 .bensz-api/task-{yyyymmdd-hhmm}-{简短描述}/auto-test-project/output/tests/ 结构完整且可追溯CHANGELOG.md 已更新最终验证命令:
# 验证所有测试会话的完整性
for session in .bensz-api/task-{yyyymmdd-hhmm}-{简短描述}/auto-test-project/output/tests/v*/; do
echo "验证: $session"
python3 auto-test-project/scripts/verify_test_session.py "$session"
done
# 验证 B 轮会话(如有)
for session in .bensz-api/task-{yyyymmdd-hhmm}-{简短描述}/auto-test-project/output/tests/B轮-*/; do
echo "验证: $session"
python3 auto-test-project/scripts/verify_test_session.py "$session"
done
| 维度 | auto-test-skill | auto-test-project |
|---|---|---|
| 目标对象 | 单个 Agent Skill | 完整项目(多模块、多文件) |
| 测试范围 | 单个 skill 目录 | 整个项目目录 |
| 问题分析 | skill 级别(SKILL.md、config.yaml) | 项目级别(跨模块、跨文件) |
| 质量检查 | 维度以 config.yaml:b_round_check.dimensions 为准 | 维度以 config.yaml:b_round_check.dimensions 为准(项目级扩展) |
| 输出位置 | 在 skill 内部的 .bensz-api/task-{yyyymmdd-hhmm}-{简短描述}/auto-test-skill/output/ 创建计划和测试会话 | 在项目根目录的 .bensz-api/task-{yyyymmdd-hhmm}-{简短描述}/auto-test-project/output/ 创建计划和测试会话 |
| CHANGELOG | 更新 skill 的 CHANGELOG.md | 更新项目的 CHANGELOG.md |
config.yamltemplates/references/FAQ.md:常见问题(如何检测“假计划/空报告”、证据标准、避免会话污染等)references/PROJECT_TESTING_BEST_PRACTICES.md:项目级测试最佳实践references/PROJECT_ISSUE_DISCOVERY_TECHNIQUES.md:项目级问题挖掘技巧 ⚠️ 强烈建议每轮使用 3-5 个技巧组合references/CRITICAL_THINKING_GUIDE.md:批判性思维指南 ⚠️ A 轮必须使用references/CONSTRUCTIVE_SUGGESTION_GUIDELINES.md:建设性建议标准(可执行、可验证、有证据)references/ANTI_PATTERNS_LIBRARY.md:反例库(快速识别项目级反模式)references/EXAMPLE_STRICT_MINIMAL.md:严格模式最小示例(P0-1 编号如何让计划-报告一致性检查落地)references/EXAMPLE_TEST_REPORT.md:完整的测试报告示例(12 个问题,展示期望的输出质量)scripts/create_test_session.py:创建测试会话目录(支持模板变量自动替换)scripts/verify_test_session.py:验证测试会话完整性(包含计划-执行一致性检查)scripts/verify_all_sessions.py:批量验证 .bensz-api/task-{yyyymmdd-hhmm}-{简短描述}/auto-test-project/output/tests/ 下的所有会话(可选严格模式)scripts/verify_skill.py:一键自检本 skill(必需文件、脚本可用、模板关键占位符自动填充)为避免 SKILL.md 过长,常见问题与最佳实践下沉到 references:
references/FAQ.mdreferences/PROJECT_TESTING_BEST_PRACTICES.md