بنقرة واحدة
empirical
こんなときに使う: skill の指示が別の実行者に明瞭に届くかを実証的に確認したいとき。skill を新規作成・大幅改訂した直後、または挙動が期待通りにならない原因を 指示側の曖昧さに求めたいとき。
التثبيت باستخدام Codex أو Claude انسخ هذا Prompt والصقه في Codex أو Claude أو مساعد آخر ليراجع صفحة Skill ويثبّتها لك.
القائمة
こんなときに使う: skill の指示が別の実行者に明瞭に届くかを実証的に確認したいとき。skill を新規作成・大幅改訂した直後、または挙動が期待通りにならない原因を 指示側の曖昧さに求めたいとき。
التثبيت باستخدام Codex أو Claude انسخ هذا Prompt والصقه في Codex أو Claude أو مساعد آخر ليراجع صفحة Skill ويثبّتها لك.
استنادا إلى تصنيف SOC المهني
こんなときに使う: Ubuntu / Linux サーバーに SSH で接続し、sudo、systemd サービス、HTTP 監視を一連で安全に進めたいとき。 接続前に SSH_AUTH_SOCK を含む認証状態を固定し、認証で止まらずに サーバー接続・権限確認・サービス起動・停止・再起動・状態確認を一気に行いたいとき。
調査→修正→検証→ふりかえり/後続 Issue 化までを 1 つの改善ループで回したいときに使う。 実装前の再現確認や、review 指摘・検証結果をもとに次のアクションへつなぐ。
こんなときに使う: 現在の会話内容をもとに、実装・エージェント発注に直結する PRD を作りたいとき。 追加のインタビューはせず、すでに会話に出ている内容だけから構成する。 情報が不足している場合は捏造せず「未確定」として明示する。
こんなときに使う: ユーザーが「インタビューして」「質問して」「設計を詰めたい」などと言ったら使う。 計画や設計の重要な判断軸を洗い出し、具体例・反例・影響範囲まで深掘りして要件整理に落とす。
Copilot の custom skill / agent / repository instructions の作成・改善・構造確認を 1 つの入口にまとめる。複合スキルとして、対象に応じて適切な authoring ルートへ 分けつつ、実行時のモデル呼び出しを抑止してルーティングを優先する。試作から `plugins/*` 配布へ昇格するときの name / description 整備も扱う。skill / agent / repo-wide instructions / path-specific instructions を新規作成したいとき、既存定義を育てたいとき、公開前に責務や導線を確かめたいとき。
新しい custom agent を既存 agent 群と同じ型で立ち上げる。agent の新規追加、役割分離のための専門 agent 作成、既存群の隙間を埋めたいとき。
| name | empirical |
| description | こんなときに使う: skill の指示が別の実行者に明瞭に届くかを実証的に確認したいとき。skill を新規作成・大幅改訂した直後、または挙動が期待通りにならない原因を 指示側の曖昧さに求めたいとき。 |
この sub-skill は、empirical-prompt-tuning skill を skill 評価の文脈 で使う際の入口です。subagent dispatch が必要なため、dispatch 不能環境では適用できません。
ゴール駆動で使うため、最初に達成したいゴール、成功条件、確認手段を短く固定します。
benchmark 比較(../benchmark/)とは測る問いが異なります。benchmark は「新版は旧版より良くなったか」、empirical は「この指示は別の実行者にも明瞭か」を問います。両者を同じ iteration で混在させないでください。
empirical-prompt-tuning skill を呼ぶこの sub-skill はルーティング用です。実際の手順は empirical-prompt-tuning に定義されています。
対象プロンプト(SKILL.md 全文)とシナリオ 2〜3 種を用意してから、empirical-prompt-tuning のワークフローに従って進めます。
empirical で「指示が明瞭である」ことが確認できたら、次の behavioral 比較が意味を持ちます。empirical でまだ不明瞭点が残るなら、benchmark を先に走らせても曖昧な改善しか得られません。
subagent dispatch ができない環境(既に subagent として動作しているなど)では、empirical-prompt-tuning の環境制約節に従い、評価を skip して上位に「empirical evaluation skipped: dispatch unavailable」と明示報告します。
empirical-prompt-tuning skill — 実際の手順はこちらに定義../benchmark/ — behavioral A/B 比較への導線empirical-prompt-tuning にあります。ここに複製すると 2 箇所の保守が発生します。empirical-prompt-tuning を直接呼んでください。