Skip to main content

evals

LLM output quality evaluation — memory/RAG evals, API response quality, tool-use correctness, prompt regression, safety/guardrails, and structured output validation. Use when: building any LLM feature, verifying AI output quality before shipping, running regression checks after prompt changes, or gating a release with quality evidence. Covers smoke/standard/comprehensive eval tiers.

Aller à l'installation

Informations de source

Dépôt
cardinalconseils/claude-starter
Dernière activité de la source
22 mai 2026 à 16:19
Langue détectée de SKILL.md
anglais
Étoiles
3
Forks
0

Options d'installation

Le prompt qui vérifie d'abord la source est sélectionné par défaut. Vous pouvez passer à une commande directe ou télécharger une copie locale.

Vérifiez les fichiers source

Lisez SKILL.md et les fichiers associés affichés par SkillsMP avant de décider de l'installer.