AI Data Contributor | Freelance – Remote (RLHF Human Feedback Ratings)
Carried out RLHF (Reinforcement Learning from Human Feedback) tasks by rating AI model responses. Evaluated outputs for helpfulness, accuracy, and safety according to provided rubrics. Helped generate reliable feedback signals for iterative model improvement. • Rated responses for helpfulness • Rated responses for accuracy • Assessed safety and compliance • Followed scoring instructions to ensure consistent feedback