Skip to main content

rl-policy-gradient

策略梯度强化学习技能 - PPO、A3C、SAC、TRPO 算法实现与机器人应用

الانتقال إلى التثبيت

معلومات المصدر

المستودع
MIUAV/vibe-coding-ros2
آخر نشاط في المصدر
٣ أبريل ٢٠٢٦ في ١٦:٣٧
لغة SKILL.md المكتشفة
الصينية
النجوم
٢٦
التفرعات
٢

خيارات التثبيت

يُحدَّد Prompt الذي يراجع المصدر أولًا بشكل افتراضي. يمكنك التبديل إلى أمر مباشر أو تنزيل نسخة محلية.

مراجعة ملفات المصدر

اقرأ SKILL.md وأي ملفات مرافقة يعرضها SkillsMP قبل أن تقرر التثبيت.