Sn4kyGit

6 mods across 1 repository, 20 stars between them.

advanced-evaluation

01

Sn4kyGit/antigravity-project-starter

Skill Claude CodeCodex

Use when the user asks to implement LLM-as-judge, compare model outputs, create evaluation rubrics, mitigate evaluation bias, or run automated quality assessments on generated outputs. Covers direct scoring and pairwise comparison.

20 5mo ago A 47 tokens