← Back to leaderboard
/100
Unscored ○ Unscored 00

AgentOps EvalBench MCP

Enables LLM evaluation and observability by uploading documents, building test sets, running RAG pipelines, and automatically scoring answers for groundedness, hallucination risk, retrieval quality, latency, and cost, with tools exposed to MCP-compatible clients.

Unscored visibility — 0/0 applicable dimensions scored
○ Schema Quality ○ Protocol — Reliability ○ Docs & Maintenance ○ Security Hygiene — Schema Interpretability
A remote probe is needed for Protocol and Reliability scores.
Schema Quality
25% weight
Protocol Compliance
20% weight
Reliability
20% weight
Docs & Maintenance
15% weight
Security Hygiene
20% weight
30-Day Trend

30-Day Uptime

30 days ago Today
Embed Badge

Add this to your README to display your MCP Scoreboard grade:

MCP Score Badge
[![MCP Score](https://mcpscoreboard.com/badge/aaaedac7-19a0-431a-977c-44e6d9b1a85e.svg)](https://mcpscoreboard.com/server/aaaedac7-19a0-431a-977c-44e6d9b1a85e/)