Skip to main content
تشغيل أي مهارة في Manus
بنقرة واحدة

vllm-mlx

النجوم٠
التفرعات٠
آخر تحديث٩ يونيو ٢٠٢٦ في ١٢:١٨

vLLM-MLX (waybarrios) — serveur d'inférence OpenAI + Anthropic compatible sur Apple Silicon. LLM/VLM avec continuous batching, MCP tool calling, multimodal, /v1/rerank (BERT) et embeddings. 400+ tok/s natif MLX. Supporte Qwen3/3.5, Llama, Gemma 4, DeepSeek-R1. Charge on-demand sur fichiers vllm-mlx ou servers.yaml.

التثبيت

التثبيت باستخدام Codex أو Claude انسخ هذا Prompt والصقه في Codex أو Claude أو مساعد آخر ليراجع صفحة Skill ويثبّتها لك.

مستكشف الملفات
3 ملفات
SKILL.md
readonly