Skip to main content

evals

Objective eval metrics via code/model/human graders with pass@k/pass^k scoring. USE WHEN eval, evaluate, test agent, benchmark, verify behavior, regression test, capability test, run eval, compare models, compare prompts, create judge, create use case, view results, failure to task, suite manager, transcript capture, trial runner.

インストールへ移動

ソース情報

リポジトリ
danielmiessler/Personal_AI_Infrastructure
ソースの最終更新活動
2026年3月15日 22:10
検出された SKILL.md の言語
英語
スター
15,967
フォーク
2,205

インストール方法

デフォルトでは、最初にソースを確認する Prompt が選択されています。直接コマンドに切り替えるか、ローカルコピーをダウンロードすることもできます。

ソースファイルを確認

インストールを決める前に、SKILL.md と SkillsMP に表示されている付属ファイルをお読みください。