AI & Technology Specialist (Freelance / Remote), AI model evaluation and training data QA (2024 – Present)
Evaluated AI-generated responses for accuracy, relevance, and safety using human-in-the-loop review practices. Provided structured feedback to improve model outputs and reduce issues such as hallucinations. Documented AI performance metrics and project outcomes to support continuous improvement. • Reviewed conversational AI responses against quality criteria • Applied structured feedback methodologies to refine outputs • Designed and tested prompts to improve factuality and safety • Produced evaluation reports and technical documentation