Skip to main content

huggingface/trl

SkillsMP ha recopilado 1 skills de huggingface/trl. Abre una skill para revisar su origen y sus detalles.

Última actividad de origen registrada
Catálogo de SkillsMP actualizado
skills recopiladas
1
Estrellas en GitHub
19.180
Forks en GitHub
2943

Skills en este repositorio

1 categorías ocupacionales · 100% clasificado

Mostrando 1 de 1 skills recopiladas.

ocupación
Científicos de datos
descripción

Post-train LLMs with TRL (Transformers Reinforcement Learning) — SFT, DPO, GRPO, KTO, and reward-model training. Use when writing or debugging training code with the TRL Python API or the trl CLI.

Idioma del texto original: inglés

actualizado
Mostrando 1 de 1 skills recopiladas.