Senior AI Evaluation Specialist | Telus International / Appen / Clickworker (AI evaluation, RLHF, labeling, transcription, and QA)
Executed RLHF tasks to train and fine-tune large language models while targeting reductions in hallucinations and improvements to helpfulness, honesty, and safety. Conducted generative AI evaluation and rating to validate model output quality against project goals. Performed lead-level data auditing to maintain annotation consistency and taxonomy compliance. • Led semantic labeling and named entity recognition (NER) labeling efforts • Performed bounding-box related annotation tasks when required • Produced multilingual audio-to-text transcription outputs following strict phonetic and grammatical guidelines • Audited global contributor work to ensure integrity and 98% quality score