AI Data Annotation Specialist (Text evaluation/ranking)
Performed pairwise comparisons and relevance ranking of AI-generated responses to support model improvement initiatives. Evaluated NLP dataset outputs to ensure they met accuracy and guideline requirements before use in downstream training. Documented quality findings and contributed to iterative refinement of labeling standards. • Conducted pairwise relevance comparisons • Ranked AI responses for quality • Validated NLP datasets for compliance • Supported feedback loops for training readiness