Skip to main content
تشغيل أي مهارة في Manus
بنقرة واحدة

llm-serving-expert

النجوم٦
التفرعات٠
آخر تحديث٢١ أبريل ٢٠٢٦ في ٠٩:٥٦

LLM serving expert: vLLM, TensorRT-LLM, Triton Inference Server, quantization (INT8/FP8/GPTQ/AWQ), continuous batching, PagedAttention, KV cache management. Use when deploying LLMs for inference.

التثبيت

التثبيت باستخدام Codex أو Claude انسخ هذا Prompt والصقه في Codex أو Claude أو مساعد آخر ليراجع صفحة Skill ويثبّتها لك.

مستكشف الملفات
5 ملفات
SKILL.md
readonly