Skip to main content

openai-evals

LLM evaluation framework and registry (OpenAI Evals). Framework for evaluating LLMs and LLM-based systems with a registry of community-contributed eval templates. Supports model-graded evals, classification, simple completion matching, and custom completion functions. Use for systematic LLM quality testing, regression detection, and prompt engineering validation.

الانتقال إلى التثبيت

معلومات المصدر

المستودع
mkurman/zorai
آخر نشاط في المصدر
٥ مايو ٢٠٢٦ في ١٠:٢٣
لغة SKILL.md المكتشفة
الإنجليزية
النجوم
٣٢٠
التفرعات
٢٦

خيارات التثبيت

يُحدَّد Prompt الذي يراجع المصدر أولًا بشكل افتراضي. يمكنك التبديل إلى أمر مباشر أو تنزيل نسخة محلية.

مراجعة ملفات المصدر

اقرأ SKILL.md وأي ملفات مرافقة يعرضها SkillsMP قبل أن تقرر التثبيت.