Skip to main content

llm-serving-auto-benchmark

Framework-independent LLM serving benchmark skill for comparing SGLang, vLLM, TensorRT-LLM, TokenSpeed, or another serving framework. Use when a user wants to find the best deployment command for one model across multiple serving frameworks under the same workload, GPU budget, and latency SLA.

Ir a la instalación

Datos de origen

Repositorio
BBuf/AI-Infra-Auto-Driven-SKILLS
Última actividad en el origen
23 de agosto de 2026 a las 14:30
Idioma detectado de SKILL.md
inglés
Estrellas
775
Forks
67

Opciones de instalación

De forma predeterminada está seleccionado el prompt que primero revisa el origen. Puedes cambiar a un comando directo o descargar una copia local.

Revisa los archivos de origen

Lee SKILL.md y los archivos complementarios que muestra SkillsMP antes de decidir si quieres instalarlo.