ワンクリックで
an-eval
按验收标准、实现可追踪性、验证证据、风险关闭和交付准备度评价 AI Native 任务完成质量。实现和验证后、关闭任务产出前,或用户询问任务是否真的完成时使用。
Codex または Claude でインストール この Prompt をコピーして Codex、Claude、または他のアシスタントに貼り付けると、Skill ページを確認してインストールできます。
メニュー
按验收标准、实现可追踪性、验证证据、风险关闭和交付准备度评价 AI Native 任务完成质量。实现和验证后、关闭任务产出前,或用户询问任务是否真的完成时使用。
Codex または Claude でインストール この Prompt をコピーして Codex、Claude、または他のアシスタントに貼り付けると、Skill ページを確認してインストールできます。
SOC 職業分類に基づく
将现有工作区转换为 AI Native 上下文结构。当用户想要:1) 将现有工作内容纳入 AI Native 格式 2) 为已有材料生成 background/conventions/artifacts 文档 3) 执行 /an-init 命令 4) 让 AI 理解并接管现有工作区 5) 从空模板开始建立通用 AI Native 上下文时触发此技能。**始终使用中文与用户沟通。**
探测、生成和运行 AI Native 可执行动作清单,包括验证、构建、检查、生成和本地执行动作。用户询问可执行规则、项目命令、验证动作,或 /an-init 后需要让 projects 工作区可被 AI 直接执行时使用。
根据实际工作区内容和结果反向更新 background 背景知识库。当用户想要:1) 刷新/更新 background 文档 2) 工作区已变但文档未同步 3) 执行 /an-refresh 命令 4) 提到"更新背景"、"刷新背景"、"同步文档"、"反推文档"等关键词时触发此技能。
根据输入的任务描述,先智能判断任务复杂度与风险,再选择 L0 直接处理、L1 快速修复、L2 标准执行或 L3 完整流程。适用于开发任务、bug 修复、内容创作、文档更新、方案设计、数据分析、研究整理、配置修改等各类 AI 协作任务。当用户想要:1) 开始一个 AI 协作任务 2) 提供了任务/票据/想法的原始描述 3) 执行 /an-task 命令 4) 提到"做"、"写"、"分析"、"设计"、"实现"、"修复"、"添加"、"更新"等执行意图时触发此技能。触发后不要默认套完整流程;小改动可不创建 artifacts,直接实现、验证并总结。
将大任务拆分为多个子任务,每个子任务的 requirements 文档控制在 200 行以内。当用户想要:1) 拆分一个大任务 2) 将任务分解为多个小任务 3) 执行 /an-task-split 命令 4) 提到"任务拆分"、"分解任务"、"大任务"、"拆分"等关键词时触发此技能。
将已完成的 artifacts 产出目录归档到 artifacts/archive/ 目录。当用户想要:1) 归档一个 artifact 2) 清理已完成的任务产出 3) 执行 /an-archive 命令 4) 提到"归档"、"整理产出"、"清理产出"、"完成归档"等关键词时触发此技能。即使用户没有明确说"归档",只要是"这个任务做完了收一下"、"把 xxx artifact 归档"之类的意图,都应使用此技能。
| name | an-eval |
| description | 按验收标准、实现可追踪性、验证证据、风险关闭和交付准备度评价 AI Native 任务完成质量。实现和验证后、关闭任务产出前,或用户询问任务是否真的完成时使用。 |
用质量评价思维判断任务是否真的完成,而不是只看产出是否修改。
node .agents/skills/an-eval/scripts/evaluate-task.mjs artifacts/{YYYYMMDD}__{feature-name}
输出 Markdown 质量报告,可保存到:
artifacts/{feature}/testing/eval-report.md
| 维度 | 重点 |
|---|---|
| 验收标准满足 | 需求文档中的验收标准是否明确并关闭 |
| 实现可追踪 | 执行规范变更清单和实现决策是否能追到实际产出 |
| 验证证据 | 是否有验证计划、执行动作、结果和失败处理 |
| 风险关闭 | 开放问题、待确认、风险项是否处理 |
| 收尾状态 | release notes、背景更新建议、归档状态是否清楚 |
| 结果 | 含义 |
|---|---|
| PASS | 可以关闭或交付 |
| REVIEW | 可以交付前人工快速看一眼 |
| BLOCKED | 不应关闭任务,先补验收标准、验证或风险处理 |