ocupação
Analistas de garantia de qualidade de software e testadores
descrição
Run Jev-native judgments on LLM assistant replies and agent trajectories using shared rubrics. Use when evaluating model output quality, safety, or tool-use trajectories before shipping or merging.
Idioma do texto original: inglês
atualizado