Skip to main content
Execute qualquer Skill no Manus
com um clique

model-benchmark

Estrelas0
Forks0
Atualizado10 de julho de 2026 às 08:24

Create, inspect, resume, analyze, integrity-verify, and seal reusable Harbor/Codex model benchmark campaigns. Use when an agent in Codex CLI, Claude Code, Gajae Code, or Hermes Agent needs to compare exact model IDs on a repository-editing dataset; reuse an existing model-benchmark workspace; run model, container-auth, and oracle gates; prevent network or oracle leakage; aggregate pass@1, latency, token, and cost results; or audit preserved benchmark artifacts.

Instalação

Instalar com Codex ou Claude Copie este prompt, cole no Codex, Claude ou outro assistente e deixe que ele revise a página da skill e instale para você.

Explorador de arquivos
9 arquivos
SKILL.md
readonly