Skip to main content

train-rl

RL training reference for the ART framework. Use when the user asks to create, write, or help with an RL training script, reinforcement learning, GRPO, reward functions, RULER scoring, rollout functions, or anything related to RL fine-tuning.

الانتقال إلى التثبيت

معلومات المصدر

المستودع
OpenPipe/ART
آخر نشاط في المصدر
٢٧ مارس ٢٠٢٦ في ٢٠:١٦
لغة SKILL.md المكتشفة
الإنجليزية
النجوم
١٠٬٦٠٢
التفرعات
٩٧٤

خيارات التثبيت

يُحدَّد Prompt الذي يراجع المصدر أولًا بشكل افتراضي. يمكنك التبديل إلى أمر مباشر أو تنزيل نسخة محلية.

مراجعة ملفات المصدر

اقرأ SKILL.md وأي ملفات مرافقة يعرضها SkillsMP قبل أن تقرر التثبيت.