AI Data Specialist / AI Training Evaluator at Outlier AI
Reviewed AI-generated summaries and conversational outputs against annotation guidelines and accuracy requirements. Evaluated responses using structured scoring rubrics to measure quality and adherence to expectations. Identified and flagged hallucinations, misinformation risks, unsafe content, and bias issues during the evaluation workflow. • Evaluated completeness, accuracy, and guideline compliance for summaries and conversations. • Applied consistent rubric-based scoring to maintain evaluation quality. • Performed hallucination detection and fact/bias risk identification. • Maintained high throughput while meeting quality standards for each task.