Skip to main content
Execute qualquer Skill no Manus
com um clique

skill-eval-model-benchmark

Estrelas0
Forks1
Atualizado10 de março de 2026 às 15:19

Run task evals across multiple Claude models and compare results side-by-side. Use when you want to understand how a skill performs across different models, identify model-specific gaps versus universal tile issues, or validate a skill before publishing it to the registry.

Instalação

Instalar com Codex ou Claude Copie este prompt, cole no Codex, Claude ou outro assistente e deixe que ele revise a página da skill e instale para você.

SKILL.md
readonly