Data Annotator Specialist — Outlier (Scale AI) (Remote)
Served as a Data Annotator Specialist performing large-scale data annotation to train machine learning and generative AI systems. Conducted Reinforcement Learning from Human Feedback (RLHF) tasks to rank AI model responses with an emphasis on safety, factual accuracy, and alignment with human values. Maintained 98%+ quality assurance across multiple complex annotation campaigns while adapting to evolving guidelines. • Annotated and labeled extensive text and multimodal datasets for LLM and generative AI training. • Completed RLHF response ranking tasks to support model safety and value alignment. • Reviewed edge cases and ambiguities, providing detailed feedback to improve annotation guidelines. • Managed high weekly task volumes while meeting productivity and deadline requirements.