Skip to main content
Jeden Skill in Manus ausführen
mit einem Klick

research-bigcode-evaluation-harness

Sterne1
Forks0
Aktualisiert13. Juli 2026 um 09:28

Evaluates code generation models across HumanEval, MBPP, MultiPL-E, and 15+ benchmarks with pass@k metrics. Use when benchmarking code models, comparing coding abilities, testing multi-language sup...

Installation

Mit Codex oder Claude installieren Kopieren Sie diesen Prompt, fügen Sie ihn in Codex, Claude oder einen anderen Assistant ein und lassen Sie die Skill-Seite prüfen und installieren.

SKILL.md
readonly