| name | pypto-skill-validation-prompt |
| description | 为任意 skill 生成校验提示词(validation prompt)。当需要验证某个 skill 的实际执行效果——即它在真实场景下产出的制品是否符合自身声明的规范——时使用。本技能的输出是一份结构化的中文校验提示词文档,可交给 AI 代理独立执行,产出一份数据驱动的优化报告。适用场景:新 skill 上线前的质量把关、现有 skill 的定期审计、skill 修改后的回归验证。触发词:校验skill、验证skill、生成校验提示词、skill验证、审计skill、skill质量评估。 |
Skill Validation Prompt Generator
为任意 skill 生成一份实证校验提示词(≤80 行),代理执行后产出数据驱动的优化报告。
本 skill 的输出是提示词,不是验证结果。
本 skill AI 代理 优化报告
生成校验提示词 ──────────▶ 执行校验提示词 ──────▶ .md 文件
(任务简报) (实证校验) (数据驱动)
输入
用户提供目标skill路径(如 .agents/skills/pypto-pass-module-analyzer),目录须含 SKILL.md。
变量提取:路径 → {skill-dir},目录名 → {skill-name}。
适用边界
负责:生成校验提示词,确保≤80行、占位符正确、场景适配。
不负责:执行提示词、产出优化报告、修改目标skill文件。
核心原则
- 实证优先:校验基于真实制品
- 引用不复制:只写路径,不内联原文
- 紧凑优先:≤80行,超标按分层裁剪
行数控制
校验提示词目标 ≤80 行。超标时按信息分层从低到高裁剪。
| 层级 | 定义 | 代理可自行补全 | 裁剪优先级 |
|---|
| L1 | 执行必需,缺失则无法工作 | ❌ | 最后砍 |
| L2 | 提升校验质量,缺失可能遗漏 | ⚠️ 部分 | 其次 |
| L3 | 与其他位置重复或可从上下文推断 | ✅ | 先砍 |
各 Section 分层
提示词包含 5 步校验(Step 1 → Step 5)。
| Section | L1(必须保留) | L2(尽量保留) | L3(优先删除) |
|---|
| 任务描述 | 校验目标 + 任务 + 产出路径 | 校验目的 | — |
| Step 1 | 构造输入 + 预期制品表 + 执行约束 | 来源阶段列 | — |
| Step 2 | 每个校验维度的规范来源路径 | 检查维度描述 | 子标题 |
| Step 3 | 只读 API + ≥5 个案例约束 | 比对维度列表 | 筛选标准细节 |
| Step 4 | 问题溯源方向 | 参考文档一致性 | 通用检查维度 |
| Step 5 | 报告保存路径 | 报告骨架 | 骨架内详细说明 |
| 约束 | 远程写操作禁止列表 | 只读操作列表 | 已重复的约束 |
裁剪手法
| 手法 | 效果 | 示例 |
|---|
| 删除重复路径/约束 | 高 | 远程操作列表已在约束段出现 |
删除分隔线 --- | 中 | 每个 1 行,4 个 = 4 行 |
| 合并同源行 | 中 | 同一制品 5 个维度 → 1-2 行 |
| 压子标题为行内粗体 | 中 | ### 交叉一致性 → 粗体前缀 |
| 删除流程概览段 | 中 | 各 Step 标题即流程 |
| 报告骨架压为 1 行 | 低 | 5 行代码块 → 1 行内联 |
校验项写法
❌ 内联原文:Tag 必须是以下之一:feat/fix/docs... — 来源:SKILL.md 阶段 3.1
✅ 引用路径:Tag 合法性(7种) + 格式 + 正则 | SKILL.md 阶段 3.1
提示词只告诉代理"查什么、去哪查",不负责"规则是什么"。
与 pypto-skill-reviewer 的关系
| pypto-skill-reviewer | 本 skill |
|---|
| 校验对象 | SKILL.md 文档质量 | Skill 实际执行效果 |
| 方法 | 静态 + 语义(52 条规则) | 本地执行 + 远程比对 + 问题溯源 |
| 输出 | 评分报告 | 校验提示词 |
两者互补:reviewer 审文档,本 skill 审执行效果。
工作流程
阶段 1: 深度分析目标 Skill
↓
阶段 2: 识别制品、规范与本地执行方式
↓
阶段 3: 生成校验提示词
↓
阶段 4: 输出与确认
阶段 1:深度分析目标 Skill
按优先级读取:
- SKILL.md — 工作流、约束、输出格式(必须)
- references/ — 参考文档、模板、规范(可选)
- scripts/ — 自动化工具逻辑(可选)
- templates/ — 输出模板(可选)
- 项目根目录 AGENTS.md — 触发词、职责边界(推荐)
分析维度:
| 维度 | 内容 |
|---|
| 类型 | 代码生成 / 文档创建 / 流程编排 / 修复工具 / 分析诊断 / 无远程交互 |
| 工作流 | 阶段划分、每阶段职责 |
| 输出制品 | 产生的文件/文本/远程操作 |
| 规范要求 | 格式/质量/内容约束 |
| 远程交互 | 远程写操作(禁止)vs 只读操作(允许) |
| 本地执行方式 | 如何在不触发远程写操作的前提下,本地执行 skill 产出真实制品 |
| 依赖 | 外部工具/MCP/环境 |
阶段 2:识别制品、规范与本地执行方式
从阶段 1 提取:
- 制品清单:skill 执行后产生的所有制品(名称 + 类型)
- 远程操作分类:远程写操作 → 禁止;只读操作 → 允许,用于收集比对数据
- 本地执行计划:如何构造典型输入、在本地执行 skill 产出真实制品(绕过远程写操作),写入提示词 Step 1
远程操作分类
| 类别 | 操作示例 | 提示词处理 |
|---|
| 远程写(禁) | git push, gitcode_create_pull_request | 填入 {具体列表} |
| 只读(允) | git fetch, gitcode_list_pull_requests | 用于比对 |
| 本地(允) | Write工具, 本地git commit | 无限制 |
阶段 3:生成校验提示词
按 references/prompt-framework.md 模板生成,写入以下 5 项要求:
- 制品生成(Step 1):构造输入 + 本地执行 + 预期制品表 + 执行约束
- 制品校验(Step 2):基于真实制品逐项校验,非理论推断
- 比对校验(Step 3):≥5 个同类案例 + 交叉验证取众数 + 双向排查
- 问题溯源(Step 4):从具体问题反推 SKILL.md 阶段缺陷
- 场景适配(贯穿):根据 skill 类型调整执行方式和校验侧重点
写作指令(约束生成者,不写入输出提示词):
- 实证优先:后续所有校验基于 Step 1 产出的真实制品
- 任务描述先行:提示词开头包含任务描述段(校验目标 + 目的 + 任务 + 产出)
- 紧凑优先:目标 ≤80 行,超标时按行数控制指南裁剪
- 引用不复制:校验项写为
检查维度 + 文件引用路径,不内联规范原文
- 单表合并:所有制品的校验维度合并为一张扁平表
阶段 4:输出与确认
保存至:{skill-name}-validation-prompt-YYYYMMDDHHMMSS.md(当前目录)
向用户展示摘要:
- 目标 skill 名称和路径
- 制品清单 + 本地执行方式
- 校验步骤概览(Step 1 → Step 5)
- 远程操作清单(禁止 vs 允许)
- 提示词行数(确认 ≤80 行)
- 提示词输出路径
场景适配
| Skill类型 | 校验侧重 | 本地执行方式 | 比对对象(≥5) | 比对来源 |
|---|
| 流程编排型(含workflow/编排关键词) | 流程完整性、远程交互正确性 | 构造输入走本地流程 | 远程PR/Issue | GitCode平台 |
| 代码生成型(含生成代码/kernel关键词) | 编译通过、API正确 | 构造规格输入生成代码 | 本地同类文件 | .agents/operators/ |
| 文档创建型(含设计文档/design关键词) | 格式规范、引用准确 | 构造主题输入生成文档 | 本地同类文档 | .agents/operators/*/design.md |
| 修复工具型(含修复fix关键词) | 修复完整、副作用小 | 构造已知问题执行修复 | 远程已修复issue | GitCode已关闭issue |
| 分析诊断型(含分析评估关键词) | 分析准确、建议可行 | 构造分析目标执行分析 | 本地历史报告 | 项目目录搜索 |
| 无远程交互型(无GitCode/git关键词) | 制品质量、格式一致 | 构造输入执行全流程 | 本地同类文件 | glob搜索 |
约束条件
- 校验提示词 ≤80 行
- 远程写操作全部禁止,只读操作允许;本地文件创建允许
- 禁止修改目标 skill 的任何文件
- 报告文件名时间戳使用实际执行时间
- 全程简体中文输出
- 校验提示词必须自包含——包含足够文件引用路径,执行者可独立读取源文件并执行
参考文件