Skip to main content

evals

Objective eval metrics via code/model/human graders with pass@k/pass^k scoring. USE WHEN eval, evaluate, test agent, benchmark, verify behavior, regression test, capability test, run eval, compare models, compare prompts, create judge, create use case, view results, failure to task, suite manager, transcript capture, trial runner.

Ir para a instalação

Informações da origem

Repositório
danielmiessler/Personal_AI_Infrastructure
Última atividade na origem
15 de março de 2026 às 22:10
Idioma detectado do SKILL.md
inglês
Estrelas
15.967
Forks
2.205

Opções de instalação

Por padrão, está selecionado o prompt que primeiro revisa a origem. Você pode mudar para um comando direto ou baixar uma cópia local.

Revise os arquivos de origem

Leia o SKILL.md e os arquivos complementares exibidos pelo SkillsMP antes de decidir se vai instalar.