Google tells you what exists. Faceabot tells you what holds up.
Evaluate one public URL for WebMCP readiness: intent, tools observed, recommended, do-not-expose.
MCP endpoint :https://mcp.webmcp-eval.com/mcp · website · measurements and detailsEvaluate a+b style arithmetic. Expression discarded.
MCP endpoint :https://agent-observatory-sensor.nolimit-observatory.workers.dev/s/calc-eval/mcp · website · measurements and detailsRegression checks for Japanese order automations: six free cases, strict JSON scoring and CI gates.
MCP endpoint :https://shigoto-dogu.netlify.app/mcp/order-eval · website · measurements and detailsPay-per-call AI evaluation MCP server. Score LLM outputs against benchmark rubrics via Workers AI.
MCP endpoint :https://eval.zuluworksai.com/mcp · website · measurements and detailsCloudflare Workers MCP server: ai-eval
MCP endpoint :https://api.lazy-mac.com/ai-eval/mcp · website · measurements and detailsRights-aware censorship, China-economic status, and tamper-evident AI evaluation tools.
MCP endpoint :https://api.seiche.info/palimpsest/mcp · website · measurements and detailsStockfish chess eval: best move, score, principal variation, multipv. $0.005/call via x402.
MCP endpoint :https://chess-eval.x402supply.com/mcp · website · measurements and detailsPrompt evals over MCP: run a prompt on your dataset, score each output 1-5 with an LLM judge.
MCP endpoint :https://completionkit.com/mcp · website · measurements and detailsAuthor verifiable eval records through a draft→review→revise→submit loop with enforced graders.
Package npm :@cyanheads/evals-mcp-server · website · measurements and detailsRemote MCP for Gemini upgrade evals, prompt regressions, output diffs, and eval receipts.
MCP endpoint :https://geminiupgradeqa.clauxel.com/mcp · website · measurements and detailsWraps the slop-eval CLI as a single generic MCP tool for genericness scoring of AI UI output.
Package pypi :slop-eval-cli · website · measurements and detailsA standardized testing harness for MCP servers and agent workflows
Package npm :mcp-eval-runner · website · measurements and detailsStatistical regression testing for LLM agents: p-value, effect size, and CI on behavior change.
Package pypi :agent-regress-cli · website · measurements and detailsStop shipping agents on vibes. Score every agent output for quality, safety, and cost.
Package npm :@iris-eval/mcp-server · website · measurements and detailsPaid remote MCP for safety replays, policy gates, eval receipts, and release evidence.
MCP endpoint :https://safetyreplay.clauxel.com/mcp · website · measurements and detailsMCP-native AI evaluation: rubric audits, eval suites, and proof reports for AI/LLM output.
MCP endpoint :https://www.rubrkit.com/api/v1/mcp · website · measurements and detailsAgent-first resource directory for AI agents: protocols, security, RAG, memory, evals, and more.
MCP endpoint :https://changegamer.ai/mcp · website · measurements and detailsBrowse MoltJobs jobs, manage owned AI agents, review evals, and place authorized USDC bids.
MCP endpoint :https://api.moltjobs.io/mcp · website · measurements and detailsBuild and monitor LLM apps on Orq.ai: AI gateway, agents, prompts, evals, traces.
MCP endpoint :https://my.orq.ai/v2/mcp · website · measurements and detailsManage Speko voice-AI agents, sessions, calls, phone numbers, knowledge bases, evals, and docs.
MCP endpoint :https://mcp.speko.ai/mcp · website · measurements and detailsAI agents: all of this is available without keys over MCP https://faceabot.com/api/mcp · HTTP https://faceabot.com/api/catalog?q=… · Guide : llms.txt
Pulse: what is changing in agent commerce · Is your store ready for AI shopping agents? · State of MCP (weekly) · MCP server doctor · Open reliability data · Add Faceabot to your AI · Help · Privacy · Terms