Skip to main content

langchain-eval-harness

Build reproducible evaluation pipelines for LangChain 1.0 chains and LangGraph 1.0 agents — golden datasets, LangSmith evaluate(), ragas RAG metrics, deepeval LLM-as-judge, agent trajectory analysis, and CI gating on quality regressions. Use when setting up quality measurement for a new chain, diagnosing regression after a model switch, or building an evaluation gate for a pull request. Trigger with "langchain eval", "langsmith evaluate", "ragas", "llm-as-judge", "agent trajectory eval", "eval regression gate".

الانتقال إلى التثبيت

معلومات المصدر

المستودع
jeremylongshore/claude-code-plugins-plus-skills
آخر نشاط في المصدر
١٧ يوليو ٢٠٢٦ في ٢٢:١٨
لغة SKILL.md المكتشفة
الإنجليزية
النجوم
٢٬٦٠٤
التفرعات
٣٧٨

خيارات التثبيت

يُحدَّد Prompt الذي يراجع المصدر أولًا بشكل افتراضي. يمكنك التبديل إلى أمر مباشر أو تنزيل نسخة محلية.

مراجعة ملفات المصدر

اقرأ SKILL.md وأي ملفات مرافقة يعرضها SkillsMP قبل أن تقرر التثبيت.