Skip to main content
تشغيل أي مهارة في Manus
بنقرة واحدة

prompt-benchmark

النجوم٦
التفرعات١
آخر تحديث٢٩ نوفمبر ٢٠٢٥ في ١٥:٥٤

Systematic prompt evaluation framework with MATH, GSM8K, and Game of 24 benchmarks. Use when evaluating prompt effectiveness on standard benchmarks, comparing meta-prompting strategies quantitatively, measuring prompt quality improvements, or validating categorical prompt optimizations against ground truth datasets.

التثبيت

التثبيت باستخدام Codex أو Claude انسخ هذا Prompt والصقه في Codex أو Claude أو مساعد آخر ليراجع صفحة Skill ويثبّتها لك.

SKILL.md
readonly