| name | an-eval |
| description | 按验收标准、实现可追踪性、验证证据、风险关闭和交付准备度评价 AI Native 任务完成质量。实现和验证后、关闭任务产出前,或用户询问任务是否真的完成时使用。 |
AI Native 任务质量评价
用质量评价思维判断任务是否真的完成,而不是只看产出是否修改。
快速使用
node .agents/skills/an-eval/scripts/evaluate-task.mjs artifacts/{YYYYMMDD}__{feature-name}
输出 Markdown 质量报告,可保存到:
artifacts/{feature}/testing/eval-report.md
评价维度
| 维度 | 重点 |
|---|
| 验收标准满足 | 需求文档中的验收标准是否明确并关闭 |
| 实现可追踪 | 执行规范变更清单和实现决策是否能追到实际产出 |
| 验证证据 | 是否有验证计划、执行动作、结果和失败处理 |
| 风险关闭 | 开放问题、待确认、风险项是否处理 |
| 收尾状态 | release notes、背景更新建议、归档状态是否清楚 |
结论规则
| 结果 | 含义 |
|---|
| PASS | 可以关闭或交付 |
| REVIEW | 可以交付前人工快速看一眼 |
| BLOCKED | 不应关闭任务,先补验收标准、验证或风险处理 |
使用约束
- 快速修复可以没有完整需求文档,但必须有实现摘要和验证记录。
- 新能力或高风险任务如果没有验收标准或验证证据,默认 BLOCKED。
- 不要为了通过质量评价伪造验证结果;不能运行的验证应记录为未运行和原因。