Skip to main content
تشغيل أي مهارة في Manus
بنقرة واحدة

fairy-tale-benchmark-feedback

النجوم١٨
التفرعات٣
آخر تحديث١٦ يوليو ٢٠٢٦ في ١٣:١٣

Apply measured benchmark feedback from SWE-Bench Pro, HLE-style closed-ended tasks, and defensive ExploitBench runs: classify misses, add narrow reusable rules, prune contradictions, and retry held-out samples without benchmark-specific hardcoding.

التثبيت

التثبيت باستخدام Codex أو Claude انسخ هذا Prompt والصقه في Codex أو Claude أو مساعد آخر ليراجع صفحة Skill ويثبّتها لك.

SKILL.md
readonly