llm-evaluation-framework
Use when performing llm evaluation framework — provides a structured framework for evaluating large language models (LLMs) for production use. Covers task-specific benchmarking, safety testing, cost analysis, latency measurement, prompt engineering evaluation, and comparison across models to select the optimal LLM for a given use case.
Informations de source
- Dépôt
- cloudthinker-ai/CloudSkills
- Dernière activité de la source
- 23 mars 2026 à 11:35
- Langue détectée de SKILL.md
- anglais
- Étoiles
- 7
- Forks
- 3
Options d'installation
Le prompt qui vérifie d'abord la source est sélectionné par défaut. Vous pouvez passer à une commande directe ou télécharger une copie locale.
Vérifiez les fichiers source
Lisez SKILL.md et les fichiers associés affichés par SkillsMP avant de décider de l'installer.