Skip to main content
Exécutez n'importe quel Skill dans Manus
en un clic

model-benchmark

Étoiles0
Forks0
Mis à jour10 juillet 2026 à 08:24

Create, inspect, resume, analyze, integrity-verify, and seal reusable Harbor/Codex model benchmark campaigns. Use when an agent in Codex CLI, Claude Code, Gajae Code, or Hermes Agent needs to compare exact model IDs on a repository-editing dataset; reuse an existing model-benchmark workspace; run model, container-auth, and oracle gates; prevent network or oracle leakage; aggregate pass@1, latency, token, and cost results; or audit preserved benchmark artifacts.

Installation

Installer avec Codex ou Claude Copiez ce prompt, collez-le dans Codex, Claude ou un autre assistant, puis laissez-le vérifier la page du skill et l'installer pour vous.

Explorateur de fichiers
9 fichiers
SKILL.md
readonly