Skip to main content

agent-evaluation

Design reproducible evaluations for AI agents with representative task sets, explicit rubrics, appropriate graders, baselines, regression gates, and failure analysis. Use when defining agent quality, comparing prompts or models, validating a release, measuring tool-use reliability, investigating regressions, or deciding whether an agent is ready for production.

الانتقال إلى التثبيت

معلومات المصدر

المستودع
seb1n/awesome-ai-agent-skills
آخر نشاط في المصدر
٩ أغسطس ٢٠٢٦ في ١٨:٥٥
لغة SKILL.md المكتشفة
الإنجليزية
النجوم
١٥١
التفرعات
٣٢

خيارات التثبيت

يُحدَّد Prompt الذي يراجع المصدر أولًا بشكل افتراضي. يمكنك التبديل إلى أمر مباشر أو تنزيل نسخة محلية.

مراجعة ملفات المصدر

اقرأ SKILL.md وأي ملفات مرافقة يعرضها SkillsMP قبل أن تقرر التثبيت.