AI Model Evaluation Specialist (Independent Contractor) - Mercor
Evaluated large language model outputs using structured scoring rubrics and provided written rationales to support model quality improvements. Rated responses across accuracy, reasoning quality, instruction-following, clarity, relevance, and overall usefulness. Performed peer review to verify consistency and alignment with project guidelines for ongoing quality control in AI response assessment workflows. • Applied detailed evaluation criteria to compare and rank multiple model responses • Produced clear written justifications for scores and improvement suggestions • Reviewed peer evaluations for accuracy, consistency, and guideline compliance • Supported quality assurance across AI evaluation and assessment workflows