Skip to main content

output-eval-validate-judge

Validate LLM judges against human labels using TPR/TNR metrics and train/dev/test splits. Use after writing a judge prompt to verify it agrees with human judgment.

الانتقال إلى التثبيت

معلومات المصدر

المستودع
growthxai/output
آخر نشاط في المصدر
٢٣ يونيو ٢٠٢٦ في ١٩:٤١
لغة SKILL.md المكتشفة
الإنجليزية
النجوم
٤٣٤
التفرعات
١٢

خيارات التثبيت

يُحدَّد Prompt الذي يراجع المصدر أولًا بشكل افتراضي. يمكنك التبديل إلى أمر مباشر أو تنزيل نسخة محلية.

مراجعة ملفات المصدر

اقرأ SKILL.md وأي ملفات مرافقة يعرضها SkillsMP قبل أن تقرر التثبيت.