Skip to main content
Manusで任意のスキルを実行
ワンクリックで

llm-evaluation

スター0
フォーク0
更新日2026年4月3日 22:04

Comprehensive LLM evaluation framework with automated metrics, LLM-as-Judge, and RAG evaluation. Trigger: When evaluating LLM outputs, building eval pipelines, comparing models, or measuring RAG quality.

インストール

Codex または Claude でインストール この Prompt をコピーして Codex、Claude、または他のアシスタントに貼り付けると、Skill ページを確認してインストールできます。

ファイルエクスプローラー
3 ファイル
SKILL.md
readonly