Skip to main content
Jeden Skill in Manus ausführen
mit einem Klick

inference-perf

Sterne4
Forks1
Aktualisiert4. Juni 2026 um 15:44

Estimate LLM inference latency, throughput, and memory requirements. Roofline model, batch sizing, KV cache analysis.

Installation

Mit Codex oder Claude installieren Kopieren Sie diesen Prompt, fügen Sie ihn in Codex, Claude oder einen anderen Assistant ein und lassen Sie die Skill-Seite prüfen und installieren.

SKILL.md
readonly