Skip to main content

mlx-vlm-inference

Usa a inferir VLM en Apple Silicon con MLX-VLM.

설치로 이동

소스 정보

저장소
Ntizar/MasterMind
최근 소스 활동
2026년 9월 5일 21:40
감지된 SKILL.md 언어
스페인어
스타
2
포크
0

설치 방법

기본적으로 소스를 먼저 확인하는 Prompt가 선택됩니다. 직접 명령으로 전환하거나 로컬 사본을 다운로드할 수도 있습니다.

소스 파일 검토

설치 여부를 결정하기 전에 SKILL.md와 SkillsMP에 표시된 보조 파일을 읽어 보세요.

SKILL.md 표시 중

SKILL.md
소스 지침 · 읽기 전용 미리보기
name
mlx-vlm-inference
description
Usa a inferir VLM en Apple Silicon con MLX-VLM.
version
2.0.0
tags
["mlx","vlm","vision-language","apple-silicon","mlx-vlm","inference"]
related_skills
["moondream-vlm","mlx-vlm-inference","huggingface-hub"]
# MLX-VLM — inference de Vision-Language en Apple Silicon > ⚠️ Corrección 2026-09-05 (auditoría): los módulos CLI `mlx_vlm.chat`/`mlx_vlm.gradio` **no existen**; el real es `mlx_vlm.generate` / `mlx_vlm.chat_ui`. Flags de server: `APC_ENABLED=1` y `--kv-bits` (no `--apc` ni `--kv-cache-quantization`); batching automático. **Repo:** `https://github.com/Blaizzy/mlx-vlm` (Python, ~5.5K⭐). ## When to Use - Cuando pidas **inferir un VLM** (texto+imagen) en Apple Silicon (MLX) de forma local y eficiente. ## Uso (API real) ```bash pip install mlx-vlm # CLI de generación: mlx_vlm.generate --model <modelo> --image img.jpg --prompt "..." # UI/servidor: mlx_vlm.chat_ui ... # (no mlx_vlm.gradio) # server con APC enable: APC_ENABLED=1 mlx_vlm.server ... --kv-bits 8 # (no --apc ni --kv-cache-quantization) ``` ## Pitfalls - Módulos: **`mlx_vlm.generate`** / **`mlx_vlm.chat_ui`**, no `chat` / `gradio`. - Server: `APC_ENABLED=1` y `--kv-bits`, no `--apc`/`--kv-cache-quantization`. - Modelos en constante evolución (Gemma 3→4); consultar el README. ## Verificación - `mlx_vlm.generate` con una imagen y un prompt sobre la imagen.
GitHub에서 보기