Skip to main content

ai-agent-evaluation

Comprehensive evaluation patterns for AI agents including multi-turn conversation testing, LLM-as-judge frameworks, benchmark suites, regression detection, and systematic eval pipelines for measuring agent quality and safety.

Aller à l'installation

Informations de source

Dépôt
PramodDutta/qaskills
Dernière activité de la source
14 avril 2026 à 07:59
Langue détectée de SKILL.md
anglais
Étoiles
201
Forks
21

Options d'installation

Le prompt qui vérifie d'abord la source est sélectionné par défaut. Vous pouvez passer à une commande directe ou télécharger une copie locale.

Vérifiez les fichiers source

Lisez SKILL.md et les fichiers associés affichés par SkillsMP avant de décider de l'installer.