Skip to main content
تشغيل أي مهارة في Manus
بنقرة واحدة

skill-eval-model-benchmark

النجوم٠
التفرعات١
آخر تحديث١٠ مارس ٢٠٢٦ في ١٥:١٩

Run task evals across multiple Claude models and compare results side-by-side. Use when you want to understand how a skill performs across different models, identify model-specific gaps versus universal tile issues, or validate a skill before publishing it to the registry.

التثبيت

التثبيت باستخدام Codex أو Claude انسخ هذا Prompt والصقه في Codex أو Claude أو مساعد آخر ليراجع صفحة Skill ويثبّتها لك.

SKILL.md
readonly