AI Trainer & Data Annotation Specialist (Freelance/Remote AI Projects)
Trained and evaluated large language models by providing RLHF feedback and ranking AI responses based on quality, accuracy, helpfulness, and tone. Produced evaluation judgments to support alignment and safety objectives, including identifying problematic outputs. Worked across multilingual content to ensure consistency of labeling signals for English and other languages. • RLHF feedback and response ranking for LLM evaluation • Quality and accuracy rating of model outputs • Bias/safety flagging for harmful or inaccurate generations • Multilingual (English/Urdu/Pashto) evaluation and annotation support