Skip to main content

llm-serving-auto-benchmark

Framework-independent LLM serving benchmark skill for comparing SGLang, vLLM, TensorRT-LLM, TokenSpeed, or another serving framework. Use when a user wants to find the best deployment command for one model across multiple serving frameworks under the same workload, GPU budget, and latency SLA.

الانتقال إلى التثبيت

معلومات المصدر

المستودع
BBuf/AI-Infra-Auto-Driven-SKILLS
آخر نشاط في المصدر
٢٣ أغسطس ٢٠٢٦ في ١٤:٣٠
لغة SKILL.md المكتشفة
الإنجليزية
النجوم
٧٧٥
التفرعات
٦٧

خيارات التثبيت

يُحدَّد Prompt الذي يراجع المصدر أولًا بشكل افتراضي. يمكنك التبديل إلى أمر مباشر أو تنزيل نسخة محلية.

مراجعة ملفات المصدر

اقرأ SKILL.md وأي ملفات مرافقة يعرضها SkillsMP قبل أن تقرر التثبيت.