Data Scientist (AI Labeling, RLHF & Evaluation)
Participated in Reinforcement Learning from Human Feedback (RLHF) and evaluation tasks to improve LLM alignment with user intent. Assisted in prompt engineering and quality assessment of AI-generated responses in production pipelines. Involved in measuring accuracy, consistency, and hallucination rates during AI model validation. • Collaborated on structured data annotation tasks for AI model optimization. • Used Python workflows and internal/proprietary tools for labeling and feedback. • Worked with LLM outputs in domains such as finance and document understanding. • Focused on improving model responsiveness and reducing error rates.