Skip to main content
Ejecuta cualquier Skill en Manus
con un clic

eval-design

Estrellas2
Forks0
Actualizado26 de junio de 2026 a las 04:44

Designs LLM evaluation frameworks with metric selection by task type, test set sizing, pass/fail thresholds, and drift triggers. Use when setting up evals for an LLM feature, before first production deployment, or when asked how to measure AI quality.

Instalación

Instalar con Codex o Claude Copia este prompt, pégalo en Codex, Claude u otro asistente, y deja que revise la página de la skill y la instale por ti.

SKILL.md
readonly