Skip to main content
Ejecuta cualquier Skill en Manus
con un clic

designing-llm-evals

Estrellas1
Forks0
Actualizado17 de junio de 2026 a las 20:23

Use when building or reviewing an evaluation for an LLM feature — assembling a representative test set, choosing pass criteria (exact match, programmatic checks, rubric, or LLM-as-judge), and catching regressions. Use when asking "how do I know this prompt or model change is better?"

Instalación

Instalar con Codex o Claude Copia este prompt, pégalo en Codex, Claude u otro asistente, y deja que revise la página de la skill y la instale por ti.

SKILL.md
readonly