Skip to main content
在 Manus 中运行任何 Skill
一键导入

claw-eval-zh

星标0
分支0
更新时间2026年6月24日 07:19

執行 claw-eval-zh 中文 agent benchmark,評估 OpenClaw agent 在中文真實任務上的表現。可用於測試模型的中文 agentic 能力、比較模型、跑 Pass^k 一致性評估,或匯出 Claw-Eval 風格的中文任務集。改編自 PinchBench,任務格式參考 Claw-Eval 中文任務風格。

安装

用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。

SKILL.md
readonly