Skip to main content
Jeden Skill in Manus ausführen
mit einem Klick

run-benchmark

Sterne0
Forks0
Aktualisiert23. Januar 2026 um 17:23

Runs SpatialVortex benchmarks (flux position accuracy, ELP accuracy, sacred boost verification, geometric reasoning, humanities final exam, performance benchmarks), compares to SOTA/baselines (GPT-4, Claude 3, BERT), generates markdown reports/tables with scores (e.g., 95% accuracy, 111.1% improvement, latency), and suggests optimizations. Automatically invoked for "run benchmarks", "benchmark SpatialVortex", "compare flux accuracy", "eval geometric reasoning", "check ASI progress", "submit results". Uses Rust benchmark suite (cargo run --bin run_benchmarks), saves JSON outputs, and prepares for GitHub PR or PapersWithCode upload.

Installation

Mit Codex oder Claude installieren Kopieren Sie diesen Prompt, fügen Sie ihn in Codex, Claude oder einen anderen Assistant ein und lassen Sie die Skill-Seite prüfen und installieren.

SKILL.md
readonly