ai-self-eval
ai-self-eval contient 11 skills collectées depuis Jason5330, avec une couverture métier par dépôt et des pages de détail sur le site.
Skills dans ce dépôt
把「感覺」變成可校準預測的執行循環。打分 → 盲預測 → 執行 → 復盤 → 進化 rubric。內置三套 rubric:日常工作任務(CL/IM/PR/SC/FO)、日常學習(RE/PK/AP/DL/AC)、AI Coding(SP/LV/TS/CO/IR)。觸發詞:"初始化"/"打分這篇"/"啟動預測"/"復盤"/"升級 rubric"/"狀態"。首次使用必須先跑 /cheat-init。
提議並執行 rubric 或 bucket 升級。兩種模式:**完整 rubric bump**(最高風險動作,5 步強制 + 跨模型審核)和 **--bucket-only 輕量重校**(只換 bucket 邊界,不動 rubric 公式)。**Phase 2 強制走 cheat-score-blind sub-agent 給校準池重打分**——不接受 self-scored fallback。觸發詞:"升級 rubric"/"bump rubric"/"更新公式"/"我想加一個維度"/"調整權重"/"重校桶"/"recalibrate bucket"。
AI Coding 的 debug 輔助 skill。用戶說出 bug 症狀時自動建立快照 + 迭代記錄,每次嘗試後判斷好壞,連續 3 次更差強制建議回滾。debug 結束後輸出結構化摘要供 cheat-retro 和 cheat-predict 校準使用。觸發詞:"我遇到 bug"/"debug 這個"/"有個錯誤"/"程式跑不起來"/"回滾"/"越改越糟"。
cheat-on-content 的首次 onboarding 與腳手架創建器。預設 AI Coding 域,只問一個問題(要不要裝 hook)。觸發詞:"初始化"/"init"/"首次使用"/"setup cheat-on-content"。必須在用戶第一次會話執行;其他子 skill 在 .cheat-state.json 不存在時自動路由到此。
把老用户的 .cheat-state.json 升级到当前 schema_version。读 migrations/registry.md 算迁移链,按顺序应用每一步迁移文件。幂等:跑两次结果一样。失败停在中间版本不前进。触发词:"迁移"/"升级 state"/"migrate"/"我的 state 是老版本"/"schema 版本不对"。
給任務/學習主題/Coding Session 寫一份 immutable 盲預測日誌。是 cheat-on-content 整個校準循環的核心動作——預測段一旦寫完不可改,由 hook 強制。打分通過 Task tool 委派給 cheat-score-blind sub-agent(context-isolated channel B),主 Claude review 後落盤。觸發詞:"啟動預測"/"start prediction"/"寫預測日誌"。
復盤 + 把新觀察寫入 rubric_notes。這是校準循環的反饋環節——不復盤的預測等於占星。觸發詞:"復盤 [path]"/"retro this"/"這次迭代復盤"/"bug 修好了"/"迭代 #N 完成"/"程式跑通了"/"功能完成了"。
INTERNAL sub-agent for blind N-dim rubric scoring. **NOT a user-facing skill — do NOT invoke from main conversation.** Called via Task tool by cheat-score / cheat-predict / cheat-bump to get a context-isolated score on a script. Receives ONLY script_path + rubric_notes_path; refuses any other input. Outputs strict JSON: N dimensions × {score 0-5, confidence enum, one-line reason}. **Hard refuses to Read** .cheat-state.json, predictions/*, sessions/*, retro 段, or anything that could leak actual outcome data. This is channel B in the 3-channel calibration model (A=main, B=blind sub, C=cross-model).
給單個任務規格/學習主題/Coding Spec 打 rubric 分。**只在控制台輸出,不寫文件,不預測**。觸發詞:"打分這篇 [path]"/"score this [path]"/"給這規格打分"/"先打分看看"。是 cheat-predict 之前的輕量探索動作。
把用戶口述的任務需求、學習目標或開發功能,整理成 cheat-predict 可讀的標準規格文件,存入 scripts/。觸發詞:"幫我整理規格"/"把需求存成規格"/"寫 spec"/"啟動任務前先存規格"/"我要做 [某功能/任務/學習目標]"。與 cheat-predict 搭配:cheat-spec 負責收集需求並落盤,cheat-predict 讀規格做盲預測。只要用戶描述了具體任務並想啟動 cheat-on-content 流程,就應使用此 skill。
cheat-on-content 的狀態看板。顯示當前域 / rubric 版本 / 校準進度 / 待復盤 / 是否該升級 rubric。任何時候都可調,無副作用。觸發詞:"狀態"/"看板"/"status"/"我現在該做什麼"/"進度怎麼樣"。