llm-evaluator
LLM-as-a-Judge evaluation system using Langfuse. Score AI outputs on relevance, accuracy, hallucination, and helpfulness. Backfill scoring on historical traces. Uses GPT-5-nano for cost-efficient judging. Use when evaluating AI quality, building evals, or monitoring output accuracy.
معلومات المصدر
- المستودع
- dvcrn/openclaw-skills-marketplace
- آخر نشاط في المصدر
- ١٥ مارس ٢٠٢٦ في ٠٩:١٣
- لغة SKILL.md المكتشفة
- الإنجليزية
- النجوم
- ٢٩
- التفرعات
- ١٠
خيارات التثبيت
يُحدَّد Prompt الذي يراجع المصدر أولًا بشكل افتراضي. يمكنك التبديل إلى أمر مباشر أو تنزيل نسخة محلية.
مراجعة ملفات المصدر
اقرأ SKILL.md وأي ملفات مرافقة يعرضها SkillsMP قبل أن تقرر التثبيت.