Skip to main content
تشغيل أي مهارة في Manus
بنقرة واحدة

claw-eval-zh

النجوم٠
التفرعات٠
آخر تحديث٢٤ يونيو ٢٠٢٦ في ٠٧:١٩

執行 claw-eval-zh 中文 agent benchmark,評估 OpenClaw agent 在中文真實任務上的表現。可用於測試模型的中文 agentic 能力、比較模型、跑 Pass^k 一致性評估,或匯出 Claw-Eval 風格的中文任務集。改編自 PinchBench,任務格式參考 Claw-Eval 中文任務風格。

التثبيت

التثبيت باستخدام Codex أو Claude انسخ هذا Prompt والصقه في Codex أو Claude أو مساعد آخر ليراجع صفحة Skill ويثبّتها لك.

SKILL.md
readonly