The Observability Index / Online Evaluation / #29
JudgmentLabs/judgeval
by JudgmentLabs · Online Evaluation · updated 2d ago
The Continuous-Improvement Stack for Agents. Our environment data and evals power agent improvement and monitoring.
68
momentum
1,060
stars
99
forks
#29
rank
agentagentic-aiagentsgrpolangchainlanggraphllama-indexllmllm-evaluationllm-observabilityopen-sourceopenai
View on GitHub →