Skip to main content

ai-agent-evaluation

Comprehensive evaluation patterns for AI agents including multi-turn conversation testing, LLM-as-judge frameworks, benchmark suites, regression detection, and systematic eval pipelines for measuring agent quality and safety.

الانتقال إلى التثبيت

معلومات المصدر

المستودع
PramodDutta/qaskills
آخر نشاط في المصدر
١٤ أبريل ٢٠٢٦ في ٠٧:٥٩
لغة SKILL.md المكتشفة
الإنجليزية
النجوم
٢٠١
التفرعات
٢١

خيارات التثبيت

يُحدَّد Prompt الذي يراجع المصدر أولًا بشكل افتراضي. يمكنك التبديل إلى أمر مباشر أو تنزيل نسخة محلية.

مراجعة ملفات المصدر

اقرأ SKILL.md وأي ملفات مرافقة يعرضها SkillsMP قبل أن تقرر التثبيت.