Skip to main content

nyosegawa/agentic-bench

SkillsMP ha recopilado 4 skills de nyosegawa/agentic-bench. Abre una skill para revisar su origen y sus detalles.

Última actividad de origen registrada
Catálogo de SkillsMP actualizado
skills recopiladas
4
Estrellas en GitHub
5
Forks en GitHub
0

Skills en este repositorio

1 categorías ocupacionales · 100% clasificado

Mostrando 4 de 4 skills recopiladas.

ocupación
Científicos de datos
descripción

Generate HTML reports and structured metrics from model evaluation results. Creates publication-ready reports with embedded outputs (images, audio, charts) and metrics.json for cross-model comparison. Use when generating reports, writing metrics, creating…

Idioma del texto original: inglés

actualizado
ocupación
Científicos de datos
descripción

Execute model inference on GPU cloud providers. Handles code generation, deployment, execution, and result collection across HF Inference API/Endpoints, Colab, Modal, beam.cloud, Vast.ai, and RunPod. Use when running models on GPU, deploying to cloud,…

Idioma del texto original: inglés

actualizado
ocupación
Científicos de datos
descripción

Investigate model specifications, requirements, and evaluation strategy. Use when researching a model before benchmarking: reading HuggingFace model cards, estimating VRAM requirements, selecting GPU providers, and determining evaluation approach. Triggers on…

Idioma del texto original: inglés

actualizado
ocupación
Científicos de datos
descripción

Autonomous model validation and benchmarking. Investigates any ML model (LLM, image gen, TTS, time series, etc.), runs it on GPU cloud, evaluates quality and performance, and generates HTML reports. Use when user asks to verify, benchmark, evaluate, or test a…

Idioma del texto original: inglés

actualizado
Mostrando 4 de 4 skills recopiladas.