AI Training and RLHF Evaluation Specialist
Performed RLHF (Reinforcement Learning from Human Feedback) preference ranking and dialogue quality evaluation on AI-generated text samples. Applied evaluation rubrics to assess multi-criteria models and took part in large-scale batch evaluations and scoring. Delivered actionable feedback to improve LLM outputs and model alignment. • Scored LLM outputs for preference using defined rubrics • Conducted dialogue quality audits focusing on factuality, logical coherence, and user intent • Participated in annotation calibration sessions and quality reviews • Used Python for data validation, cleaning, and aggregation.