Skip to main content

rl-policy-optimization

Best practices for reinforcement learning policy optimization. Use when working on RL agents, PPO, SAC, or reward design.

الانتقال إلى التثبيت

معلومات المصدر

المستودع
aiming-lab/AutoResearchClaw
آخر نشاط في المصدر
٢٣ مارس ٢٠٢٦ في ٠١:٤٦
لغة SKILL.md المكتشفة
الإنجليزية
النجوم
١٣٬٩٧٤
التفرعات
١٬٦٣٣

خيارات التثبيت

يُحدَّد Prompt الذي يراجع المصدر أولًا بشكل افتراضي. يمكنك التبديل إلى أمر مباشر أو تنزيل نسخة محلية.

مراجعة ملفات المصدر

اقرأ SKILL.md وأي ملفات مرافقة يعرضها SkillsMP قبل أن تقرر التثبيت.