Skip to main content

trl-training

Train and fine-tune transformer language models using TRL (Transformers Reinforcement Learning). Supports SFT, DPO, GRPO, KTO, RLOO and Reward Model training via CLI commands.

Aller à l'installation

Informations de source

Dépôt
huggingface/skills
Dernière activité de la source
3 août 2026 à 18:50
Langue détectée de SKILL.md
anglais
Étoiles
10 990
Forks
737

Options d'installation

Le prompt qui vérifie d'abord la source est sélectionné par défaut. Vous pouvez passer à une commande directe ou télécharger une copie locale.

Vérifiez les fichiers source

Lisez SKILL.md et les fichiers associés affichés par SkillsMP avant de décider de l'installer.