Data Annotator, Mercor May 2026 - Present
Designed rubric criteria for evaluating multilingual AI model responses across English and Spanish. Evaluated AI model outputs for accuracy, relevance, and overall quality using self-designed and platform rubrics. Applied the rubrics to support consistent prompt-response assessment in ongoing multilingual projects. • Defined evaluation rubric criteria for model response quality • Scored and assessed AI outputs for accuracy and relevance • Used structured rubrics to ensure consistent multilingual judgments • Iterated on rubric usage across English/Spanish projects