Online AI Training & Data Labeling Associate at Outlier AI
Evaluated generative AI outputs for relevance, factual consistency, and linguistic quality to support model improvement. Contributed to reinforcement learning feedback (RLHF) workflows and iterative annotation refinement for better dataset categorization. Reviewed outputs against quality criteria to sustain high daily performance. • Assessed output relevance and factual consistency against task requirements • Evaluated linguistic quality and adherence to expected language norms • Participated in RL feedback/refinement cycles to improve categorization efficiency • Maintained high review scores while exceeding daily annotation targets