Skip to main content

huggingface/trl

O SkillsMP coletou 1 skills de huggingface/trl. Abra uma skill para revisar a origem e os detalhes.

Última atividade de origem registrada
Catálogo do SkillsMP atualizado
skills coletadas
1
Estrelas no GitHub
19.180
Forks no GitHub
2.943

Skills neste repositório

1 categorias ocupacionais · 100% classificado

Mostrando 1 de 1 skills coletadas.

ocupação
Cientistas de dados
descrição

Post-train LLMs with TRL (Transformers Reinforcement Learning) — SFT, DPO, GRPO, KTO, and reward-model training. Use when writing or debugging training code with the TRL Python API or the trl CLI.

Idioma do texto original: inglês

atualizado
Mostrando 1 de 1 skills coletadas.