Senior AI Quality & Content Evaluation Specialist (Remote International AI Projects)
Led remote international evaluation work for AI-generated content and model outputs, covering instruction following, groundedness, factual accuracy, harmful content detection, and overall response quality. Performed RLHF-style assessments including preference ranking and quality benchmarking to support conversational AI improvements. Reviewed and moderated user-generated and AI-generated outputs to ensure compliance with safety policies, community guidelines, and platform standards. • Evaluated large volumes of text and multimodal AI outputs • Flagged hallucinations, unsafe outputs, and policy violations • Produced structured analytical feedback and maintained quality metrics above 96% • Used SOPs and escalation protocols for confidential AI safety operations