AI Platform Trainer & Multimodal Evaluation Specialist — Mercor AI
Served as an AI Platform Trainer & Multimodal Evaluation Specialist performing structured quality evaluation of multimodal model outputs. Evaluated video, audio, visual, and text-based responses for accuracy, relevance, instruction-following, consistency, and user-intent alignment to support model improvement and dataset quality. Identified hallucinations, weak outputs, and specific visual/audio task failures, then provided feedback to improve reliability and response quality. • Ranked and compared AI-generated outputs using structured rubrics, task guidelines, and defined quality criteria • Reviewed outputs for linguistic quality, accuracy, relevance, consistency, and instruction-following • Detected hallucinations and failure modes including visual errors, audio inconsistencies, and recurring pattern failures • Completed high-volume quality review work requiring precision, judgment, and attention to detail