AI Data Evaluator & Annotator - Outlier (RLHF support)
You supported RLHF workflows by reviewing model responses and providing ratings and refinements to guide safer and more helpful outputs. You applied domain knowledge in writing and technology to produce high-quality annotations. You ensured labeled outputs met platform standards for accuracy and consistency. • Provided ratings for model outputs as part of RLHF • Refined responses through structured annotation • Applied domain knowledge for higher-quality labeling • Met platform productivity and quality expectations