Skip to main content
تشغيل أي مهارة في Manus
بنقرة واحدة

upgrade-evals

النجوم١٦
التفرعات٣
آخر تحديث٤ مارس ٢٠٢٦ في ١٨:٤٥

Systematic error analysis on real AI traces. Read traces, judge pass/fail, let failure categories emerge from data, compute failure rates, decide what to fix. Use when you have 50+ test cases or are seeing production failures. Do NOT use when you have fewer than 20 test cases (use /start-evals first).

التثبيت

التثبيت باستخدام Codex أو Claude انسخ هذا Prompt والصقه في Codex أو Claude أو مساعد آخر ليراجع صفحة Skill ويثبّتها لك.

SKILL.md
readonly