Skip to main content

bench-open-model

Benchmark any open-weight vLLM-servable Hugging Face model on AWS GPU hardware. Sizes the model's VRAM needs, picks the right EC2 GPU instance type and region, provisions it, serves the model on vLLM, runs a cache-honest concurrency sweep, writes a report, and tears everything down. Use when asked to benchmark / test / evaluate the throughput, latency, or serving capacity of an open-weight model on AWS, pick a GPU instance type for a model, size VRAM for a model, or measure tokens-per-second or requests-per-day. Covers text LLMs and multimodal / vision / OCR models.

Ir a la instalación

Datos de origen

Repositorio
aws-samples/sample-gpu-open-weight-bench
Última actividad en el origen
6 de agosto de 2026 a las 08:50
Idioma detectado de SKILL.md
inglés
Estrellas
1
Forks
0

Opciones de instalación

De forma predeterminada está seleccionado el prompt que primero revisa el origen. Puedes cambiar a un comando directo o descargar una copia local.

Revisa los archivos de origen

Lee SKILL.md y los archivos complementarios que muestra SkillsMP antes de decidir si quieres instalarlo.