AI Evaluator (Contract) — Mercor (Remote)
Evaluated AI-generated text outputs for accuracy, reasoning quality, and overall response quality using detailed rubrics. Provided ratings and constructive critiques to support model improvement and iterative refinement. Worked across multiple business and education-related domains, aligning judgments with specified evaluation criteria. • Assessed outputs against rubric-based scoring guidelines • Delivered written critiques to highlight issues and suggest improvements • Evaluated domains including strategy, operations/SOPs, procurement, and program management • Performed quality checks intended to inform downstream model updates