Skip to main content
تشغيل أي مهارة في Manus
بنقرة واحدة

fit-benchmark

النجوم٣
التفرعات٠
آخر تحديث١٩ يوليو ٢٠٢٦ في ١٠:٣١

Prove whether a skill-pack change made agents better at writing code. Use when a single passing eval doesn't prove anything and you need multi-run pass@k evidence, when grading coding tasks with hidden tests the agent cannot see, or when comparing outcomes across skill-set versions.

التثبيت

التثبيت باستخدام Codex أو Claude انسخ هذا Prompt والصقه في Codex أو Claude أو مساعد آخر ليراجع صفحة Skill ويثبّتها لك.

مستكشف الملفات
3 ملفات
SKILL.md
readonly