一键导入
an-eval
按验收标准、实现可追踪性、测试证据、风险关闭和发布准备度评价 AI Native 任务完成质量。实现和测试后、关闭任务产出前,或用户询问任务是否真的完成时使用。
用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
菜单
按验收标准、实现可追踪性、测试证据、风险关闭和发布准备度评价 AI Native 任务完成质量。实现和测试后、关闭任务产出前,或用户询问任务是否真的完成时使用。
用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
将已完成的 artifacts 产出目录归档到 artifacts/archive/ 目录。当用户想要:1) 归档一个 artifact 2) 清理已完成的任务产出 3) 执行 /an-archive 命令 4) 提到"归档"、"整理产出"、"清理产出"、"完成归档"等关键词时触发此技能。即使用户没有明确说"归档",只要是"这个任务做完了收一下"、"把 xxx artifact 归档"之类的意图,都应使用此技能。
将现有工程转换为 AI Native 项目结构。当用户想要:1) 将现有项目转换为 AI Native 格式 2) 为已有代码生成 background/conventions/artifacts 文档 3) 执行 /an-init 命令 4) 让 AI 理解并接管现有项目 时触发此技能。**始终使用中文与用户沟通。**
探测、生成和运行 AI Native 可执行命令清单,包括验证、构建、代码检查、类型检查、代码生成和本地开发命令。用户询问可执行规则、项目命令、验证命令,或 /an-init 后需要让 repos 工程可被 AI 直接运行时使用。
根据实际代码和结果反向更新 background 背景知识库。当用户想要:1) 刷新/更新 background 文档 2) 代码已变但文档未同步 3) 执行 /an-refresh 命令 4) 提到"更新背景"、"刷新背景"、"同步文档"、"反推文档"等关键词时触发此技能。
根据输入的任务描述,先智能判断任务复杂度与风险,再选择 L0 直接处理、L1 快速修复、L2 标准开发或 L3 完整流程。适用于开发任务、bug 修复、代码重构、配置修改、文档更新、需求实现等。当用户想要:1) 开始一个开发任务 2) 提供了任务/票据/想法的原始描述 3) 执行 /an-task 命令 4) 提到"开发"、"实现"、"修复"、"添加"等关键词时触发此技能。触发后不要默认套完整流程;小改动可不创建 artifacts,直接实现、验证并总结。
将大任务拆分为多个子任务,每个子任务的 requirements 文档控制在 200 行以内。当用户想要:1) 拆分一个大任务 2) 将任务分解为多个小任务 3) 执行 /an-task-split 命令 4) 提到"任务拆分"、"分解任务"、"大任务"、"拆分"等关键词时触发此技能。
基于 SOC 职业分类
| name | an-eval |
| description | 按验收标准、实现可追踪性、测试证据、风险关闭和发布准备度评价 AI Native 任务完成质量。实现和测试后、关闭任务产出前,或用户询问任务是否真的完成时使用。 |
用质量评价思维判断任务是否真的完成,而不是只看代码是否修改。
node .agents/skills/an-eval/scripts/evaluate-task.mjs artifacts/{YYYYMMDD}__{feature-name}
输出 Markdown 质量报告,可保存到:
artifacts/{feature}/testing/eval-report.md
| 维度 | 重点 |
|---|---|
| 验收标准满足 | 需求文档中的验收标准是否明确并关闭 |
| 实现可追踪 | 技术规范变更清单和实现决策是否能追到代码 |
| 测试证据 | 是否有测试计划、执行命令、结果和失败处理 |
| 风险关闭 | 开放问题、待确认、风险项是否处理 |
| 收尾状态 | release notes、背景更新建议、归档状态是否清楚 |
| 结果 | 含义 |
|---|---|
| PASS | 可以关闭或交付 |
| REVIEW | 可以交付前人工快速看一眼 |
| BLOCKED | 不应关闭任务,先补验收标准、测试或风险处理 |