Skip to main content

opik-evaluate

Build an LLM evaluation and run it against your app, returning an experiment with scores. Covers datasets, LLM judges, RAG evaluation, synthetic data, error analysis, and validating evaluators against human labels. Use when the user wants to measure or improve AI product quality, or asks about evals, judges, or evaluation metrics.

الانتقال إلى التثبيت

معلومات المصدر

المستودع
comet-ml/opik-mcp
آخر نشاط في المصدر
٢٨ أغسطس ٢٠٢٦ في ١١:٢٨
لغة SKILL.md المكتشفة
الإنجليزية
النجوم
٢١٧
التفرعات
٣٦

خيارات التثبيت

يُحدَّد Prompt الذي يراجع المصدر أولًا بشكل افتراضي. يمكنك التبديل إلى أمر مباشر أو تنزيل نسخة محلية.

مراجعة ملفات المصدر

اقرأ SKILL.md وأي ملفات مرافقة يعرضها SkillsMP قبل أن تقرر التثبيت.