Skip to main content

agent-eval-flywheel

Use this skill to evaluate an ADK agent with Google's Agent Quality Flywheel, run an evalset, choose the right metric, and read the results. Covers the ADK metric menu and which metrics run locally versus which call an AI judge, how the LLM judge scores meaning rather than words, how a rubric judge writes a plain-English reason for each verdict graded against trusted evidence, and how to close the eval fix loop. SDKs and tools used, agents-cli, adk eval, google-adk[eval], the Gemini API for the agent and the judge.

الانتقال إلى التثبيت

معلومات المصدر

المستودع
SaschaHeyer/gen-ai-livestream
آخر نشاط في المصدر
١٠ يوليو ٢٠٢٦ في ٠٨:٣٣
لغة SKILL.md المكتشفة
الإنجليزية
النجوم
١٨٨
التفرعات
٦٦

خيارات التثبيت

يُحدَّد Prompt الذي يراجع المصدر أولًا بشكل افتراضي. يمكنك التبديل إلى أمر مباشر أو تنزيل نسخة محلية.

مراجعة ملفات المصدر

اقرأ SKILL.md وأي ملفات مرافقة يعرضها SkillsMP قبل أن تقرر التثبيت.