Skip to main content

rlhf-systems

Human-feedback-driven model optimization — preference data collection, reward modeling, policy updates, and alignment evaluation.

Ir para a instalação

Informações da origem

Repositório
a5c-ai/babysitter
Última atividade na origem
7 de maio de 2026 às 20:19
Idioma detectado do SKILL.md
inglês
Estrelas
1.652
Forks
96

Opções de instalação

Por padrão, está selecionado o prompt que primeiro revisa a origem. Você pode mudar para um comando direto ou baixar uma cópia local.

Revise os arquivos de origem

Leia o SKILL.md e os arquivos complementares exibidos pelo SkillsMP antes de decidir se vai instalar.