Skip to main content

server-inference

Use this skill when the user wants to run or debug MLX-VLM server inference, including uv run mlx_vlm.server, /v1/models, /v1/chat/completions, /v1/responses, streaming, OpenAI-compatible clients, health checks, metrics, model unload/reload, adapters, trust-remote-code, and server request/response failures.

Aller à l'installation

Informations de source

Dépôt
Blaizzy/mlx-vlm
Dernière activité de la source
4 août 2026 à 00:28
Langue détectée de SKILL.md
anglais
Étoiles
5 361
Forks
731

Options d'installation

Le prompt qui vérifie d'abord la source est sélectionné par défaut. Vous pouvez passer à une commande directe ou télécharger une copie locale.

Vérifiez les fichiers source

Lisez SKILL.md et les fichiers associés affichés par SkillsMP avant de décider de l'installer.