Skip to main content
تشغيل أي مهارة في Manus
بنقرة واحدة

vllm-tgi-inference

النجوم١٦
التفرعات٣
آخر تحديث٢٨ مايو ٢٠٢٦ في ٠٢:١١

Deploy and serve LLMs locally with vLLM or TGI. Use when launching vllm serve, running TGI Docker, configuring tensor parallelism, serving quantized models, using OpenAI-compatible API, tuning KV cache, or diagnosing OOM errors.

التثبيت

التثبيت باستخدام Codex أو Claude انسخ هذا Prompt والصقه في Codex أو Claude أو مساعد آخر ليراجع صفحة Skill ويثبّتها لك.

مستكشف الملفات
5 ملفات
SKILL.md
readonly