Skip to main content

trl-training

Post-train LLMs with TRL (Transformers Reinforcement Learning) — SFT, DPO, GRPO, KTO, and reward-model training. Use when writing or debugging training code with the TRL Python API or the trl CLI.

Aller à l'installation

Informations de source

Dépôt
huggingface/trl
Dernière activité de la source
26 août 2026 à 19:09
Langue détectée de SKILL.md
anglais
Étoiles
19 180
Forks
2 943

Options d'installation

Le prompt qui vérifie d'abord la source est sélectionné par défaut. Vous pouvez passer à une commande directe ou télécharger une copie locale.

Vérifiez les fichiers source

Lisez SKILL.md et les fichiers associés affichés par SkillsMP avant de décider de l'installer.