Skip to main content
تشغيل أي مهارة في Manus
بنقرة واحدة

vllm-omni-distributed

النجوم٨٢
التفرعات٢٥
آخر تحديث٢٤ مايو ٢٠٢٦ في ٠٨:٣٣

Scale vLLM-Omni across multiple GPUs and nodes using tensor parallelism, pipeline parallelism, OmniConnector disaggregation, connector backends, and Ray. Use when setting up multi-GPU inference, distributing model execution across machines, deploying disaggregated execution, developing OmniConnector backends, or scaling inference horizontally.

التثبيت

التثبيت باستخدام Codex أو Claude انسخ هذا Prompt والصقه في Codex أو Claude أو مساعد آخر ليراجع صفحة Skill ويثبّتها لك.

مستكشف الملفات
4 ملفات
SKILL.md
readonly