Skip to main content
Manus에서 모든 스킬 실행
원클릭으로
GitHub 저장소

eval-engineer

eval-engineer에는 Galileo-Agent-Labs에서 수집한 skills 8개가 있으며, 저장소 수준 직업 범위와 사이트 내 skill 상세 페이지를 제공합니다.

수집된 skills
8
Stars
37
업데이트
2026-05-29
Forks
6
직업 범위
직업 카테고리 2개 · 100% 분류됨
저장소 탐색

이 저장소의 skills

eval-diagnose
소프트웨어 개발자

Use when Galileo evidence is available and the user asks why a trace, session, log stream, experiment, metric, or AI app behavior failed, regressed, or became unsafe.

2026-05-29
eval-engineer
소프트웨어 개발자

Use when a user is unsure which Eval Engineer command to run for AI agents/RAG apps, needs onboarding/status for a .galileo workspace, or asks where to start.

2026-05-29
eval-setup
소프트웨어 개발자

Use when the user asks to set up Eval Engineer, check .galileo readiness, create workspace scaffolding, or configure editable files, verification commands, app type, or evidence paths.

2026-05-29
eval-audit
소프트웨어 품질 보증 분석가·테스터

Use when the user asks for an AI app audit, launch readiness review, safety/security review, OWASP agentic risk check, metric coverage review, or production RCA gap review.

2026-05-26
eval-cost
소프트웨어 개발자

Use when the user asks to make an AI app cheaper or faster, reduce tokens, latency, model/tool/retrieval/rerank/self-check/retry/evaluator cost, or compare cost before/after.

2026-05-26
eval-dataset
소프트웨어 품질 보증 분석가·테스터

Use when the user asks to turn a failure into an eval, create/review/accept/reject dataset cases, or convert Galileo traces, metric gaps, or production examples into cases.

2026-05-26
eval-fetch
소프트웨어 개발자

Use when a user asks to fetch Galileo evidence, provides Galileo URLs or IDs, says "fetch this Galileo link", or needs traces, sessions, experiments, or log streams saved locally.

2026-05-26
eval-measure
소프트웨어 품질 보증 분석가·테스터

Use when the user asks if an AI app is measured correctly, needs Galileo metrics, expected-output contracts, metric profiles, eval gates, or measurement before optimizing.

2026-05-26