Skip to main content
تشغيل أي مهارة في Manus
بنقرة واحدة

designing-llm-evals

النجوم١
التفرعات٠
آخر تحديث١٧ يونيو ٢٠٢٦ في ٢٠:٢٣

Use when building or reviewing an evaluation for an LLM feature — assembling a representative test set, choosing pass criteria (exact match, programmatic checks, rubric, or LLM-as-judge), and catching regressions. Use when asking "how do I know this prompt or model change is better?"

التثبيت

التثبيت باستخدام Codex أو Claude انسخ هذا Prompt والصقه في Codex أو Claude أو مساعد آخر ليراجع صفحة Skill ويثبّتها لك.

SKILL.md
readonly