Skip to main content
تشغيل أي مهارة في Manus
بنقرة واحدة

build-eval-dataset

النجوم٢٦
التفرعات٨
آخر تحديث٥ يوليو ٢٠٢٦ في ١٠:٣١

Use this to build a good evaluation dataset for an LLM app, the part everyone underestimates. Trigger on "make an eval set", "what should I test my LLM on", "I don't have test data for my prompt", "build a golden dataset", or before setting up evals. A great eval set beats a great metric; garbage-in means your evals lie to you.

التثبيت

التثبيت باستخدام Codex أو Claude انسخ هذا Prompt والصقه في Codex أو Claude أو مساعد آخر ليراجع صفحة Skill ويثبّتها لك.

SKILL.md
readonly