Freelance AI Trainer & Data Quality Specialist | Prolific & CloudResearch Connect
Evaluated AI-generated responses for factual accuracy, semantic reasoning, safety, constraints, and overall helpfulness while ensuring strict data integrity under evolving guidelines. Compared and ranked multiple LLM outputs using rigorous evaluation matrices to support model training data improvements. Performed dataset annotation, categorization, and quality assurance tasks aligned to project requirements. • AI model evaluation across accuracy, reasoning, safety, and helpfulness • Dataset labeling and quality assurance • LLM output comparison and ranking using evaluation matrices • Prompt authorship and refinement to stress-test model behavior