Skip to main content

grpo-finetuning

Implement GRPO (Group Relative Policy Optimization) fine-tuning for vision-language models on small datasets. Use when SFT underperforms or training data is limited (<1000 examples).

الانتقال إلى التثبيت

معلومات المصدر

المستودع
aws-solutions-library-samples/guidance-for-claude-code-with-amazon-bedrock
آخر نشاط في المصدر
٢٧ يناير ٢٠٢٦ في ١٨:٤٧
لغة SKILL.md المكتشفة
الإنجليزية
النجوم
٣٩٦
التفرعات
١٥٤

خيارات التثبيت

يُحدَّد Prompt الذي يراجع المصدر أولًا بشكل افتراضي. يمكنك التبديل إلى أمر مباشر أو تنزيل نسخة محلية.

مراجعة ملفات المصدر

اقرأ SKILL.md وأي ملفات مرافقة يعرضها SkillsMP قبل أن تقرر التثبيت.