Skip to main content

advanced-evaluation

Production-grade techniques for evaluating LLM outputs using LLMs as judges. Use when implementing LLM-as-judge, comparing model outputs, creating evaluation rubrics, mitigating evaluation bias, or building automated quality assessment pipelines.

Ir a la instalación

Datos de origen

Repositorio
rawwerks/Agent-Skills-for-Context-Engineering-compliant
Última actividad en el origen
12 de enero de 2026 a las 05:39
Idioma detectado de SKILL.md
inglés
Estrellas
0
Forks
0

Opciones de instalación

De forma predeterminada está seleccionado el prompt que primero revisa el origen. Puedes cambiar a un comando directo o descargar una copia local.

Revisa los archivos de origen

Lee SKILL.md y los archivos complementarios que muestra SkillsMP antes de decidir si quieres instalarlo.