Skip to main content

llm-evaluation

Implement comprehensive evaluation strategies for LLM applications using automated metrics, human feedback, and benchmarking. Use when testing LLM performance, measuring AI application quality, or establishing evaluation frameworks.

الانتقال إلى التثبيت

معلومات المصدر

المستودع
Dicklesworthstone/pi_agent_rust
آخر نشاط في المصدر
٥ فبراير ٢٠٢٦ في ٠٦:٥٦
لغة SKILL.md المكتشفة
الإنجليزية
النجوم
١٬٥٨٠
التفرعات
١٨٤

خيارات التثبيت

يُحدَّد Prompt الذي يراجع المصدر أولًا بشكل افتراضي. يمكنك التبديل إلى أمر مباشر أو تنزيل نسخة محلية.

مراجعة ملفات المصدر

اقرأ SKILL.md وأي ملفات مرافقة يعرضها SkillsMP قبل أن تقرر التثبيت.