—
/100
Unscored
○ Unscored 0⁄0
AgentOps EvalBench MCP
Enables LLM evaluation and observability by uploading documents, building test sets, running RAG pipelines, and automatically scoring answers for groundedness, hallucination risk, retrieval quality, latency, and cost, with tools exposed to MCP-compatible clients.
Unscored visibility
— 0/0 applicable dimensions scored
○ Schema Quality
○ Protocol
— Reliability
○ Docs & Maintenance
○ Security Hygiene
— Schema Interpretability
A remote probe is needed for Protocol and Reliability scores.
Schema Quality
—
25% weight
Protocol Compliance
—
20% weight
Reliability
—
20% weight
Docs & Maintenance
—
15% weight
Security Hygiene
—
20% weight
30-Day Uptime
30 days ago
Today