Sn4kyGit/antigravity-project-starter
Skill Claude CodeCodex
Use when the user asks to implement LLM-as-judge, compare model outputs, create evaluation rubrics, mitigate evaluation bias, or run automated quality assessments on generated outputs. Covers direct scoring and pairwise comparison.