Skip to main content

evals

LLM output quality evaluation — memory/RAG evals, API response quality, tool-use correctness, prompt regression, safety/guardrails, and structured output validation. Use when: building any LLM feature, verifying AI output quality before shipping, running regression checks after prompt changes, or gating a release with quality evidence. Covers smoke/standard/comprehensive eval tiers.

インストールへ移動

ソース情報

リポジトリ
cardinalconseils/claude-starter
ソースの最終更新活動
2026年5月22日 16:19
検出された SKILL.md の言語
英語
スター
3
フォーク
0

インストール方法

デフォルトでは、最初にソースを確認する Prompt が選択されています。直接コマンドに切り替えるか、ローカルコピーをダウンロードすることもできます。

ソースファイルを確認

インストールを決める前に、SKILL.md と SkillsMP に表示されている付属ファイルをお読みください。