Skip to main content

llm-evaluation-framework

Use when performing llm evaluation framework — provides a structured framework for evaluating large language models (LLMs) for production use. Covers task-specific benchmarking, safety testing, cost analysis, latency measurement, prompt engineering evaluation, and comparison across models to select the optimal LLM for a given use case.

الانتقال إلى التثبيت

معلومات المصدر

المستودع
cloudthinker-ai/CloudSkills
آخر نشاط في المصدر
٢٣ مارس ٢٠٢٦ في ١١:٣٥
لغة SKILL.md المكتشفة
الإنجليزية
النجوم
٧
التفرعات
٣

خيارات التثبيت

يُحدَّد Prompt الذي يراجع المصدر أولًا بشكل افتراضي. يمكنك التبديل إلى أمر مباشر أو تنزيل نسخة محلية.

مراجعة ملفات المصدر

اقرأ SKILL.md وأي ملفات مرافقة يعرضها SkillsMP قبل أن تقرر التثبيت.