trl-post-training
Use when building, reviewing, or editing TRL post-training workflows for agentic applications, including SFT, DPO, GRPO, RLOO, reward modeling, dataset formats, chat templates, assistant/completion-only losses, tool-calling data, reward functions, and challenge progression from SFT to environment-based RL.
Datos de origen
- Repositorio
- burtenshaw/training-agents
- Última actividad en el origen
- 15 de junio de 2026 a las 13:42
- Idioma detectado de SKILL.md
- inglés
- Estrellas
- 95
- Forks
- 17
Opciones de instalación
De forma predeterminada está seleccionado el prompt que primero revisa el origen. Puedes cambiar a un comando directo o descargar una copia local.
Revisa los archivos de origen
Lee SKILL.md y los archivos complementarios que muestra SkillsMP antes de decidir si quieres instalarlo.