Skip to main content

trl-training

Train and fine-tune transformer language models using TRL (Transformers Reinforcement Learning). Supports SFT, DPO, GRPO, KTO, RLOO and Reward Model training via CLI commands.

الانتقال إلى التثبيت

معلومات المصدر

المستودع
huggingface/skills
آخر نشاط في المصدر
٣ أغسطس ٢٠٢٦ في ١٨:٥٠
لغة SKILL.md المكتشفة
الإنجليزية
النجوم
١٠٬٩٩٠
التفرعات
٧٣٧

خيارات التثبيت

يُحدَّد Prompt الذي يراجع المصدر أولًا بشكل افتراضي. يمكنك التبديل إلى أمر مباشر أو تنزيل نسخة محلية.

مراجعة ملفات المصدر

اقرأ SKILL.md وأي ملفات مرافقة يعرضها SkillsMP قبل أن تقرر التثبيت.