Skip to main content

spinning-up-deep-rl

Knowledge base from "Spinning Up in Deep RL" by Joshua Achiam (OpenAI, MIT-licensed). Use when applying Achiam's frameworks for RL fundamentals and MDPs, the model-free algorithm taxonomy, policy gradient derivations, the six reference algorithms (VPG, TRPO, PPO, DDPG, TD3, SAC), debugging silently-failing RL code, or running rigorous multi-seed RL experiments.

الانتقال إلى التثبيت

معلومات المصدر

المستودع
alirezarezvani/claude-skills
آخر نشاط في المصدر
٢٥ أغسطس ٢٠٢٦ في ١٨:٤٩
لغة SKILL.md المكتشفة
الإنجليزية
النجوم
٢٥٬٢٤٢
التفرعات
٣٬٥٧٧

خيارات التثبيت

يُحدَّد Prompt الذي يراجع المصدر أولًا بشكل افتراضي. يمكنك التبديل إلى أمر مباشر أو تنزيل نسخة محلية.

مراجعة ملفات المصدر

اقرأ SKILL.md وأي ملفات مرافقة يعرضها SkillsMP قبل أن تقرر التثبيت.