Skip to main content

huggingface/trl

SkillsMP는 huggingface/trl에서 1개의 skill을 수집했습니다. skill을 열어 소스와 세부 정보를 확인하세요.

최근 기록된 소스 활동
SkillsMP 카탈로그 업데이트
수집된 skills
1
GitHub 스타
19,180
GitHub 포크
2,943

이 저장소의 skills

직업 카테고리 1개 · 100% 분류됨

수집된 skill 1개 중 1개를 표시합니다.

직업 분류
데이터 과학자
설명

Post-train LLMs with TRL (Transformers Reinforcement Learning) — SFT, DPO, GRPO, KTO, and reward-model training. Use when writing or debugging training code with the TRL Python API or the trl CLI.

원문 언어: 영어

업데이트
수집된 skill 1개 중 1개를 표시합니다.