AI Training & Data Specialist (RLHF, Prompt Engineering, AI Evaluation/Response Ranking)
Supported RLHF-related work by evaluating model behavior and response quality against defined instructions. Conducted prompt assessment and model output evaluation to identify strengths, weaknesses, and failure patterns. Ensured outputs met quality standards through iterative review and guideline-driven scoring.•Evaluated responses for adherence, helpfulness, and accuracy•Assessed prompt quality and response alignment•Flagged issues to inform improvements to training data and guidelines•Contributed to AI evaluation and red-team style analysis through rating and review