Skip to main content
Ejecuta cualquier Skill en Manus
con un clic

skill-eval-model-benchmark

Estrellas0
Forks1
Actualizado10 de marzo de 2026 a las 15:19

Run task evals across multiple Claude models and compare results side-by-side. Use when you want to understand how a skill performs across different models, identify model-specific gaps versus universal tile issues, or validate a skill before publishing it to the registry.

Instalación

Instalar con Codex o Claude Copia este prompt, pégalo en Codex, Claude u otro asistente, y deja que revise la página de la skill y la instale por ti.

SKILL.md
readonly