Skip to main content

metacognition-as-reward

"Metacognition-as-Reward (MaR) — metacognition-inspired RL framework for LLM reasoning. Use when training LLMs to reason better through RL: (1) improving reasoning quality beyond final-answer correctness, (2) providing reward signals for intermediate reasoning behaviors, (3) replacing hand-crafted rubrics with general metacognitive dimensions, (4) training models for process-level reasoning quality.

الانتقال إلى التثبيت

معلومات المصدر

المستودع
hiyenwong/ai_collection
آخر نشاط في المصدر
١٣ يوليو ٢٠٢٦ في ٠٢:٠٠
لغة SKILL.md المكتشفة
الإنجليزية
النجوم
٢
التفرعات
٠

خيارات التثبيت

يُحدَّد Prompt الذي يراجع المصدر أولًا بشكل افتراضي. يمكنك التبديل إلى أمر مباشر أو تنزيل نسخة محلية.

مراجعة ملفات المصدر

اقرأ SKILL.md وأي ملفات مرافقة يعرضها SkillsMP قبل أن تقرر التثبيت.