llm-eval mcp servers

3 tagged llm-eval, measured the same way as everything else here.

evals

01

homemade-software-inc/completion-kit

MCP server Claude CodeCodexCursor +2

Prompt evals over MCP: run a prompt on your dataset, score each output 1-5 with an LLM judge. Remote server at completionkit.com.

3 21d ago A tokens not measured

trustmodel-mcp

02

karlmehta/trustmodel-mcp

MCP server Claude CodeCodexCursor

Score any AI for trust across 10 dimensions; evaluate, monitor & govern LLMs and agents. Runs locally from the @trustmodel/mcp-server npm package. Needs 2 environment variables to run.

1 19d ago A tokens not measured

mcp-cocktail

03

asavs/mcp-cocktail

MCP server Claude CodeCodexCursor +2

MCP server "mcp-cocktail" as configured in asavs/mcp-cocktail. Runs locally from the mcp-cocktail Python package.

0 20d ago A tokens not measured original MIT