Senior AI Data Trainer & Content Evaluator (Remote)
Evaluated and ranked AI-generated outputs for accuracy, coherence, factual consistency, and safety compliance using structured rubrics. Assessed reasoning quality and identified hallucinations in large language model responses, while applying consistent scoring criteria across tasks. Conducted multimedia labeling and assessment supporting model training and evaluation workflows. • Accuracy and coherence scoring • Hallucination detection using rubrics • Safety and policy compliance checks • Structured feedback for model improvement