Skip to main content

experiment

Triple-blind AI testing protocol for scientifically rigorous experiments that test AI behavior changes (e.g. CLAUDE.md variants, prompt strategies) while eliminating coordinator and evaluator bias. Use when the user wants to run /experiment, design a controlled A/B test of AI behavior, compare control vs treatment configurations with a blind evaluator, or needs anti-hallucination / instruction-following experiments with standardized 0-100 rubrics. Covers design, autorun automation, execute, evaluate, and reveal phases plus real experiment results and lessons learned.

Aller à l'installation

Informations de source

Dépôt
jleechanorg/claude-commands
Dernière activité de la source
2 août 2026 à 01:06
Langue détectée de SKILL.md
anglais
Étoiles
3
Forks
0

Options d'installation

Le prompt qui vérifie d'abord la source est sélectionné par défaut. Vous pouvez passer à une commande directe ou télécharger une copie locale.

Vérifiez les fichiers source

Lisez SKILL.md et les fichiers associés affichés par SkillsMP avant de décider de l'installer.