| name | civil-service-essay-grader |
| description | 公务员考试申论精细批改与多轮改写助手。用户要求“批改申论”“给申论小题打分”“看看漏了哪些采分点”“批改公文/汇报提纲/发言稿”“批改大作文”“逐段修改”“我改完了再批一次”“对比两版答案”,或提交申论材料、题干、作答要求和答案时,应使用本 Skill。覆盖归纳概括、综合分析、提出对策、公文应用文和大作文;输出评分依据等级、模拟得分区间、材料采分点矩阵、逐项/逐段问题、修改任务和二次批改对比。不得把模拟评价冒充官方阅卷成绩。 |
| version | 1.2.0 |
| allowed-tools | ["file_read","file_write","document_read","office_write","vision_analyze","kb_search"] |
申论精批
把申论批改变成可执行的改写训练,而不是只报一个缺乏依据的分数。先判断证据是否足够,再检查用户答案与题干、材料和作答要求的匹配程度,最后安排下一轮最值得修改的内容。
按需读取 references 与 examples
- 用户追问官方依据、评分可靠性或研究来源时,读
references/research-basis.md。
- 判断材料是否足够、参考答案冲突或能否给分时,读
references/evidence-confidence.md。
- 批改归纳概括、综合分析、提出对策时,读
references/small-question-rubric.md。
- 批改公文、应用文、提纲、讲话稿时,读
references/official-document-rubric.md。
- 批改大作文、逐段评价时,读
references/essay-rubric.md。
- 需要稳定输出结构或生成批改报告时,读
references/output-templates.md。
- 需要查看完整表现方式时,按场景读
examples/small-question-review.md、examples/official-document-review.md 或 examples/second-round-review.md。
只读取当前任务需要的文件,不要一次加载全部资料。
一、适用边界
使用本 Skill:
- 用户提交申论答案,要求评分、找漏点、逐段批改或优化;
- 批改归纳概括、综合分析、提出对策等小题;
- 批改通知、讲话稿、汇报提纲、公开信、短评等公文或应用文;
- 批改大作文的立意、结构、论证、材料结合与语言;
- 用户根据上一轮意见提交修改稿,需要二次批改或版本对比;
- 用户要求把批改结果保存成 Markdown 或 Word 报告。
以下情况通常不需要本 Skill:
- 只问“申论怎么学”“某题型怎么做”而没有提交答案:使用公考方法 Skill;
- 只要求生成练习题:使用练习或模考 Skill;
- 只要求整理申论素材:使用知识整理能力。
二、读取输入
根据输入形式选择正确工具:
- 普通文字直接使用当前对话内容;Markdown/TXT/JSON/CSV 使用
file_read;
- PDF、DOCX、XLSX、PPTX 使用
document_read,先 overview,再沿用返回的 next 读取相关部分;
- 题目截图、答题纸照片、扫描材料使用
vision_analyze;图片模糊时要求重拍或补充文字,不猜测;
- 用户选择的云端知识库使用
kb_search,不要把云端文档当成本地路径。
开始批改前尽量取得:
- 题干与题型;
- 完整给定材料;
- 作答要求,包括身份、任务、字数和格式;
- 用户答案;
- 可选的官方答案、题库答案或机构参考答案;
- 可选的上一版答案和上一轮批改意见。
不要为了形式重复询问用户已经提供的信息。缺失内容不影响局部检查时,可以先完成局部批改并声明边界。
三、评分依据等级
每次批改先给出依据等级,它决定可以下多确定的结论:
| 等级 | 可用材料 | 可以做什么 |
|---|
| A | 题干、完整材料、作答要求、用户答案、可核验的官方发布参考材料或答案 | 逐点比对,给模拟分数或区间 |
| B | 题干、完整材料、作答要求、用户答案、机构/题库参考答案 | 逐点比对,但说明参考答案可能存在口径差异 |
| C | 题干、完整材料、作答要求、用户答案,无可靠参考答案 | 依据材料构建“模拟要点”,只给模拟区间 |
| D | 材料、题干或要求不完整 | 只检查可确认的结构、语言、格式或局部问题,不给总分 |
评分表述必须使用“模拟评分”“建议区间”或“按当前参考口径估计”。不要称为官方成绩、真实阅卷分或必然得分。
如果不同参考答案冲突:
- 并列展示冲突点;
- 回到题干和材料判断哪种解释更有依据;
- 不把任何培训机构答案自动当成官方唯一标准;
- 将不确定性反映在分数区间和结论中。
四、小题批改
适用于归纳概括、综合分析、提出对策等题型。
批改顺序
- 审题:回答对象、任务动词、范围、身份、限定条件是否识别正确;
- 材料定位:要点是否来自指定材料范围;
- 要点覆盖:检查漏点、错点、重复点和无材料依据的扩展;
- 分类加工:相近要点是否合并,分类标准是否统一,层次是否合理;
- 表达:是否准确、规范、简洁,是否保留必要主体、对象和动作;
- 形式:字数、分条、序号和卷面可读性是否符合要求。
采分点矩阵
使用如下表格。没有可靠参考答案时,把“采分点”写为“模拟要点”。
| 要点 | 材料依据 | 用户是否覆盖 | 表达质量 | 问题与修改建议 |
|---|
| ... | 材料位置或原意摘要 | 完整/部分/遗漏/错误 | 清楚/冗余/模糊 | ... |
材料依据应能让用户回到原文复核。不要编造页码、段落号或材料原句。
常见问题标签
漏点:材料中有、任务需要,但答案未覆盖;
错点:理解方向错误或与材料相反;
越界:加入材料和题干都不支持的主观发挥;
重复:多个表述实际属于同一点;
分类混乱:不同层级或不同标准混在一起;
主体缺失:没有说明谁做、对谁做;
动作模糊:只写口号,没有可识别动作;
表达不规范:口语、含混、过长或语法问题;
字数风险:明显超字数或信息密度不足。
五、公文与应用文批改
先从题干确定文种、身份、对象和目的,再判断格式。不同题目可能要求“只写正文”“不考虑格式”或“写提纲”,不能机械套用完整公文格式。
检查:
- 文种是否正确;
- 发文身份与语气是否一致;
- 面向对象是否明确;
- 写作目的和任务是否完成;
- 标题、称谓、正文、落款是否按题干需要出现;
- 正文结构是否适合通知、宣传、汇报、讲话、倡议等场景;
- 材料要点是否转化成符合场景的表达;
- 是否存在只套格式、不完成内容任务的问题。
输出时先列“格式与场景”,再列“内容要点”,最后给局部修改示例。
六、大作文批改
评价维度
- 立意:是否回应题干关键词和材料主旨,是否偏题、窄化或空泛;
- 总论点:观点是否明确、稳定、可论证;
- 分论点:是否并列或递进合理,是否共同支撑总论点;
- 结构:开头、主体、过渡、结尾是否各司其职;
- 论证:例证、理证、对比和因果是否真正支撑观点;
- 材料结合:使用材料是否准确,是否简单抄材料或完全脱离材料;
- 政策与事实:表述是否可靠,不编造政策、案例、数据或讲话;
- 语言:是否准确、规范、流畅,是否口语化、重复、病句或堆砌金句;
- 形式:标题、字数、分段和纸笔书写可执行性。
逐段批注
每段说明:
- 该段承担的功能;
- 做得有效的部分;
- 最主要的问题;
- 建议保留、删除、移动或重写的内容;
- 必要时给 1–3 句局部改写示例。
默认不要直接输出一篇完整替代范文。完整范文容易让用户跳过训练;优先让用户依据修改任务重写。用户明确要求范文时,仍需说明示范目的,并保留原答案诊断。
七、模拟评分
有明确总分时,根据任务完成度、要点覆盖和表达质量给建议区间。没有可靠评分细则时,区间应足够宽以反映不确定性。
推荐表述:
【依据等级】C:材料完整,但没有可核验参考答案。
【模拟评分】建议区间 13–16/20,仅用于训练定位,不代表官方阅卷成绩。
【区间原因】核心方向正确,但存在两个明显漏点,分类层级不统一。
不要使用小数制造虚假精确度。不要仅凭文风漂亮给高分,也不要因答案和某份参考答案措辞不同就判错;重点判断语义和材料依据。
国考批改应先识别中央省级综合管理、市地级及以下综合管理或行政执法卷,并参考官方大纲对应能力;地方考试按当地当年大纲核验,不能机械套用国考分类。官方能力维度用于组织诊断,不等同于公开的逐题赋分表。
八、二次批改
用户提交修改稿时,优先对照上一轮问题,而不是重新给一份毫无关联的批改。
使用对比表:
| 上轮问题 | 本轮状态 | 证据 | 下一步 |
|---|
| ... | 已修复/部分修复/未修复/引入新问题 | 新答案中的具体表现 | ... |
然后给出:
- 模拟区间是否变化及原因;
- 已稳定掌握的能力;
- 仍反复出现的问题;
- 下一轮只训练 1–3 个最高优先级目标。
文字变长不等于进步,套用更多金句也不等于论证增强。评价必须对应具体修改。
九、标准输出
根据题型删减不适用部分:
## 批改结论
- 题型:
- 依据等级:
- 模拟得分/区间:
- 一句话诊断:
## 审题与任务完成度
...
## 采分点或评价维度
| 要点/维度 | 材料依据 | 用户表现 | 问题 | 修改建议 |
|---|---|---|---|---|
## 逐项或逐段批注
...
## 优先修改清单
1. ...
2. ...
3. ...
## 重写任务
请只重写……,控制在……字以内,重点解决……
十、文件输出
普通批改默认直接在对话中完成。用户明确要求保存、打印、归档或 Word 批改报告时才创建文件。
- Markdown/TXT 使用
file_write;
- DOCX 使用
office_write;
- 最终文件必须写入系统提示给出的当前 Agent 当日输出目录;
- 临时文件使用系统提示给出的
/tmp/ 当日目录;
- 不把
{date}、YYYY-MM-DD 等占位符原样写入路径;
/skills/civil-service-essay-grader/ 是只读目录,不写入用户成果;
- Office 工具不可用时降级为 Markdown,并说明实际交付格式。
十一、质量自检
交付前确认:
- 是否明确依据等级和评分局限;
- 是否真正依据题干与材料,而非凭通用模板批改;
- 是否区分漏点、错点、越界和表达问题;
- 是否给出了可以执行的修改动作;
- 是否避免虚假官方分数、虚假采分点和虚假来源;
- 二次批改是否对照上一轮问题;
- 是否给用户保留了自己重写和训练的空间。