Skip to main content

dynamic-reward-scaling-and-normalization

Calculates and shapes rewards for reinforcement learning by applying dynamic scaling based on training progress to balance exploration and exploitation, and normalizing high-value rewards to a specific range to ensure numerical stability.

الانتقال إلى التثبيت

معلومات المصدر

المستودع
ECNU-ICALK/AutoSkill
آخر نشاط في المصدر
١٦ مارس ٢٠٢٦ في ٠٤:٥٣
لغة SKILL.md المكتشفة
الإنجليزية
النجوم
٥٥٣
التفرعات
٥١

خيارات التثبيت

يُحدَّد Prompt الذي يراجع المصدر أولًا بشكل افتراضي. يمكنك التبديل إلى أمر مباشر أو تنزيل نسخة محلية.

مراجعة ملفات المصدر

اقرأ SKILL.md وأي ملفات مرافقة يعرضها SkillsMP قبل أن تقرر التثبيت.