Skip to main content

trl-sft

Use when designing, implementing, reviewing, or debugging supervised fine-tuning with TRL SFTTrainer or `trl sft`, especially for agentic models trained on chat messages, prompt/completion data, tool-calling examples, assistant-only loss, completion-only loss, LoRA/PEFT adapters, Trackio logging, or agent trace datasets such as `julien-c/synthtraces`.

الانتقال إلى التثبيت

معلومات المصدر

المستودع
burtenshaw/training-agents
آخر نشاط في المصدر
١٥ يونيو ٢٠٢٦ في ١٣:٤٢
لغة SKILL.md المكتشفة
الإنجليزية
النجوم
٩٥
التفرعات
١٧

خيارات التثبيت

يُحدَّد Prompt الذي يراجع المصدر أولًا بشكل افتراضي. يمكنك التبديل إلى أمر مباشر أو تنزيل نسخة محلية.

مراجعة ملفات المصدر

اقرأ SKILL.md وأي ملفات مرافقة يعرضها SkillsMP قبل أن تقرر التثبيت.