Senior Data Scientist – AI Output Evaluator
Evaluated outputs from large language models and identified statistical and logical inconsistencies. Conducted systematic reviews of AI-generated content for quality, fairness, and accuracy. Contributed feedback for reinforcement learning from human feedback (RLHF) processes. • Analyzed text outputs using internal/proprietary tooling and Python utilities. • Collaborated with data science and engineering teams to calibrate model evaluation protocols. • Refined prompt instructions to facilitate more effective AI learning cycles. • Provided metrics-driven feedback to inform model improvement roadmaps.