with one click
meta-agent
meta-agent contains 12 collected skills from slowman2084, with repository-level occupation coverage and site-owned skill detail pages.
Skills in this repository
评估体系调试专家(Debug/Calibrate)。诊断 rubric、理想态、提示词三元组的一致性问题,输出 calibration_report.json。内部专用,不面向用户。
评估 Sub Agent 输出质量的评分专家,根据评分标准和参考答案对实际输出进行打分。内部专用,不面向用户。
根据用户提供的业务场景和需求,运用 AI Agent 理想态设计最佳实践,生成结构完整、可落地的理想态文档。内部专用,不面向用户。
平台日志转换器,将平台测试执行日志(stdout)转换为 ShareGPT 格式 JSON,支持转换脚本缓存和复用。内部专用,不面向用户。
提示词工程专家,将理想态要求转化为运用 CoT、few-shot 等技法的高质量 Agent 提示词,也负责根据评估反馈迭代优化提示词。内部专用,不面向用户。
迭代优化全局复盘专家。分析多轮提示词迭代历史,识别反模式和劣化主线,输出 forced_new_directions。内部专用,不面向用户。
专门为 LLM-as-a-Judge 生成任务专属、可判定、可去偏的评分标准(Rubric)。内部专用,不面向用户。
根据 Agent 提示词和理想态描述,自动生成高质量的 YAML 测试用例。内部专用,不面向用户。
Platform Skill 示例 — 展示如何将 meta-agent 的测试流程适配到外部执行平台
Agent/Skill 迭代优化编排器。执行多轮 test→optimize→review→re-test 循环,支持 warmup、baseline、sampling、verify 四阶段策略。触发词:iterate、迭代优化、开始迭代。
Agent & Skill Factory 总控入口。根据用户意图(plan / create / test / iterate / calibrate / enrich)生成规划文件,按规划驱动原子 meta-* Skills 执行。支持断点续跑。触发词:/meta-plan、/meta-plan agent、/meta-plan skill、test、create、iterate、calibrate、enrich(为已有 Skill 逆向补全理想态+测试用例)。
提示词反作弊审查专家,独立审查提示词是否存在作弊(抄袭 ExpectedOutput)、过拟合或泛化性不足的问题。内部专用,不面向用户。