ワンクリックで
empirical
こんなときに使う: skill の指示が別の実行者に明瞭に届くかを実証的に確認したいとき。skill を新規作成・大幅改訂した直後、または挙動が期待通りにならない原因を 指示側の曖昧さに求めたいとき。
Codex または Claude でインストール この Prompt をコピーして Codex、Claude、または他のアシスタントに貼り付けると、Skill ページを確認してインストールできます。
メニュー
こんなときに使う: skill の指示が別の実行者に明瞭に届くかを実証的に確認したいとき。skill を新規作成・大幅改訂した直後、または挙動が期待通りにならない原因を 指示側の曖昧さに求めたいとき。
Codex または Claude でインストール この Prompt をコピーして Codex、Claude、または他のアシスタントに貼り付けると、Skill ページを確認してインストールできます。
SOC 職業分類に基づく
こんなときに使う: Ubuntu / Linux サーバーに SSH で接続し、sudo、systemd サービス、HTTP 監視を一連で安全に進めたいとき。 接続前に SSH_AUTH_SOCK を含む認証状態を固定し、認証で止まらずに サーバー接続・権限確認・サービス起動・停止・再起動・状態確認を一気に行いたいとき。
調査→修正→検証→ふりかえり/後続 Issue 化までを 1 つの改善ループで回したいときに使う。 実装前の再現確認や、review 指摘・検証結果をもとに次のアクションへつなぐ。
こんなときに使う: 現在の会話内容をもとに、実装・エージェント発注に直結する PRD を作りたいとき。 追加のインタビューはせず、すでに会話に出ている内容だけから構成する。 情報が不足している場合は捏造せず「未確定」として明示する。
こんなときに使う: ユーザーが「インタビューして」「質問して」「設計を詰めたい」などと言ったら使う。 計画や設計の重要な判断軸を洗い出し、具体例・反例・影響範囲まで深掘りして要件整理に落とす。
Copilot の custom skill / agent / repository instructions の作成・改善・構造確認を 1 つの入口にまとめる。複合スキルとして、対象に応じて適切な authoring ルートへ 分けつつ、実行時のモデル呼び出しを抑止してルーティングを優先する。試作から `plugins/*` 配布へ昇格するときの name / description 整備も扱う。skill / agent / repo-wide instructions / path-specific instructions を新規作成したいとき、既存定義を育てたいとき、公開前に責務や導線を確かめたいとき。
新しい custom agent を既存 agent 群と同じ型で立ち上げる。agent の新規追加、役割分離のための専門 agent 作成、既存群の隙間を埋めたいとき。
| name | empirical |
| description | こんなときに使う: skill の指示が別の実行者に明瞭に届くかを実証的に確認したいとき。skill を新規作成・大幅改訂した直後、または挙動が期待通りにならない原因を 指示側の曖昧さに求めたいとき。 |
この sub-skill は、empirical-prompt-tuning skill を skill 評価の文脈 で使う際の入口です。subagent dispatch が必要なため、dispatch 不能環境では適用できません。
ゴール駆動で使うため、最初に達成したいゴール、成功条件、確認手段を短く固定します。
benchmark 比較(../benchmark/)とは測る問いが異なります。benchmark は「新版は旧版より良くなったか」、empirical は「この指示は別の実行者にも明瞭か」を問います。両者を同じ iteration で混在させないでください。
empirical-prompt-tuning skill を呼ぶこの sub-skill はルーティング用です。実際の手順は empirical-prompt-tuning に定義されています。
対象プロンプト(SKILL.md 全文)とシナリオ 2〜3 種を用意してから、empirical-prompt-tuning のワークフローに従って進めます。
empirical で「指示が明瞭である」ことが確認できたら、次の behavioral 比較が意味を持ちます。empirical でまだ不明瞭点が残るなら、benchmark を先に走らせても曖昧な改善しか得られません。
subagent dispatch ができない環境(既に subagent として動作しているなど)では、empirical-prompt-tuning の環境制約節に従い、評価を skip して上位に「empirical evaluation skipped: dispatch unavailable」と明示報告します。
empirical-prompt-tuning skill — 実際の手順はこちらに定義../benchmark/ — behavioral A/B 比較への導線empirical-prompt-tuning にあります。ここに複製すると 2 箇所の保守が発生します。empirical-prompt-tuning を直接呼んでください。