Skip to main content
تشغيل أي مهارة في Manus
بنقرة واحدة

eval

النجوم٢٦
التفرعات٨
آخر تحديث٢٥ أبريل ٢٠٢٦ في ٢١:٣٠

AI/LLM evaluation. Benchmark creation, regression testing, statistical significance, LLM-as-judge, promptfoo.

التثبيت

التثبيت باستخدام Codex أو Claude انسخ هذا Prompt والصقه في Codex أو Claude أو مساعد آخر ليراجع صفحة Skill ويثبّتها لك.

SKILL.md
readonly