Galileo-Agent-Labs

9 mods across 1 repository, 41 stars between them.

Galileo-Agent-Labs/eval-engineer

Instructions file CodexOpenCode

Instructions for Galileo-Agent-Labs/eval-engineer, covering agent instructions, project intent, read first, skill rules and skill package hygiene.

41 20d ago A 1,930 tokens original MIT

eval-audit

02

Galileo-Agent-Labs/eval-engineer

Skill Claude CodeCodex

Use when the user asks for an AI app audit, launch readiness review, safety/security review, OWASP agentic risk check, metric coverage review, or production RCA gap review.

41 20d ago A 40 tokens original MIT

eval-cost

03

Galileo-Agent-Labs/eval-engineer

Skill Claude CodeCodex

Use when the user asks to make an AI app cheaper or faster, reduce tokens, latency, model/tool/retrieval/rerank/self-check/retry/evaluator cost, or compare cost before/after.

41 20d ago A 45 tokens original MIT

eval-dataset

04

Galileo-Agent-Labs/eval-engineer

Skill Claude CodeCodex

Use when the user asks to turn a failure into an eval, create/review/accept/reject dataset cases, or convert Galileo traces, metric gaps, or production examples into cases.

41 20d ago A 41 tokens original MIT

eval-diagnose

05

Galileo-Agent-Labs/eval-engineer

Skill Claude CodeCodex

Use when Galileo evidence is available and the user asks why a trace, session, log stream, experiment, metric, or AI app behavior failed, regressed, or became unsafe.

41 20d ago A 41 tokens original MIT

eval-engineer

06

Galileo-Agent-Labs/eval-engineer

Skill Claude CodeCodex

Use when a user is unsure which Eval Engineer command to run for AI agents/RAG apps, needs onboarding/status for a .galileo workspace, or asks where to start.

41 20d ago A 39 tokens original MIT

eval-fetch

07

Galileo-Agent-Labs/eval-engineer

Skill Claude CodeCodex

Use when a user asks to fetch Galileo evidence, provides Galileo URLs or IDs, says "fetch this Galileo link", or needs traces, sessions, experiments, or log streams saved locally.

41 20d ago A 40 tokens original MIT

eval-measure

08

Galileo-Agent-Labs/eval-engineer

Skill Claude CodeCodex

Use when the user asks if an AI app is measured correctly, needs Galileo metrics, expected-output contracts, metric profiles, eval gates, or measurement before optimizing.

41 20d ago A 36 tokens original MIT

eval-setup

09

Galileo-Agent-Labs/eval-engineer

Skill Claude CodeCodex

Use when the user asks to set up Eval Engineer, check .galileo readiness, create workspace scaffolding, or configure editable files, verification commands, app type, or evidence paths.

41 20d ago A 41 tokens original MIT