AI Evaluation Specialist (Contract) — Mercor (2026–Present)
Evaluates AI-generated textual content using structured evaluation frameworks covering reasoning quality, communication effectiveness, accuracy, and user experience. Produces detailed written analytical feedback and assessments to support AI model training and quality improvement initiatives. Participates in AI evaluation and red-teaming workflows requiring nuanced judgment and behavioral analysis. • Rated/assessed outputs for quality, coherence, and human-centered response effectiveness • Added detailed written feedback to guide iterative model improvements • Applied qualitative and quantitative research methods to evaluate communication • Conducted policy-aligned, red-teaming related review practices