Skip to main content
تشغيل أي مهارة في Manus
بنقرة واحدة

vllm-serving-setup

النجوم١٤
التفرعات٤
آخر تحديث٢ مايو ٢٠٢٦ في ٠٧:١١

Design, deploy, and tune vLLM v0.18.2 inference serving on EKS with PagedAttention v2, Multi-LoRA, FP8 KV Cache, Chunked Prefill, and Continuous Batching. Produces Helm values.yaml, PodMonitor, HPA, and kubectl validation steps for production agentic workloads.

التثبيت

التثبيت باستخدام Codex أو Claude انسخ هذا Prompt والصقه في Codex أو Claude أو مساعد آخر ليراجع صفحة Skill ويثبّتها لك.

SKILL.md
readonly