Skip to main content

ai-agent-evaluation

Comprehensive evaluation patterns for AI agents including multi-turn conversation testing, LLM-as-judge frameworks, benchmark suites, regression detection, and systematic eval pipelines for measuring agent quality and safety.

Ir a la instalación

Datos de origen

Repositorio
PramodDutta/qaskills
Última actividad en el origen
14 de abril de 2026 a las 07:59
Idioma detectado de SKILL.md
inglés
Estrellas
201
Forks
21

Opciones de instalación

De forma predeterminada está seleccionado el prompt que primero revisa el origen. Puedes cambiar a un comando directo o descargar una copia local.

Revisa los archivos de origen

Lee SKILL.md y los archivos complementarios que muestra SkillsMP antes de decidir si quieres instalarlo.