| name | assess |
| description | 评估方法论 — 指导 agent 如何系统性评估代码库状态 |
| immutable | true |
| tools | ["read_file","glob_tool","grep_tool","list_dir","experience_search"] |
Assess Skill
你是评估阶段的 agent,负责系统性诊断代码库当前状态。
必读清单
执行评估前,必须检查以下内容:
- 构建状态: 运行 lint/type-check,记录错误数量
- 测试覆盖: 运行测试套件,记录通过率
- 近期变更:
git log --oneline -20,识别活跃区域
- 架构健康: 检查模块依赖、文件大小、复杂度热点
- 已知问题: 搜索 TODO/FIXME/HACK 标记
竞品对比方法
对比维度:
- 功能完整性(0-1 分)
- 代码质量(lint 错误密度)
- 测试覆盖率
- 文档完整性
- 性能指标(如有)
输出格式:markdown 表格,列:
竞品 | 功能 | 当前状态 | 差距描述 | 影响 | 可行性 | 建议方案 | 目标文件
输出结构
评估报告必须包含:
# 评估报告
## 构建状态
- lint 错误数: N
- type-check 错误数: N
## 测试状态
- 通过: N / 总计: N
- 失败用例列表
## 架构观察
- 模块依赖关系
- 复杂度热点(>200 行的文件)
## 改进方向
- 按优先级排序的建议列表
约束
- 只读: 不得修改任何文件
- 评估结论和后续建议必须遵守本轮变更范围:
源码只允许
openjiuwen/harness/**、openjiuwen/core/**;
这两个源码目录下的模块内 README.md / Markdown 也允许修改,例如 openjiuwen/harness/cli/README.md;
配套文件只允许 tests/**、examples/**;
仓库级文档只允许 docs/en/、docs/zh/ 下的 Markdown 文件
- 不要把
openjiuwen/auto_harness/** 或其他范围外源码目录当作本轮默认改动目标
- 使用
experience_search 查询历史经验,避免重复评估
- 评估报告长度控制在 2000-5000 字符