Research & AI Evaluation Specialist (Freelance)
Conducted AI response evaluation by reviewing model outputs against detailed rubrics and project requirements. Assessed instruction-following, factual accuracy, logical consistency, formatting, and completeness while producing written QA reports. Verified information using authoritative and publicly available sources to ensure correctness before publication. • Created structured prompts and evaluation scenarios for AI reasoning and instruction-following assessment. • Identified factual errors, reasoning gaps, and formatting issues in AI-generated responses. • Produced detailed written evaluations and structured feedback for improving model performance. • Organized complex results into reference documents while meeting strict formatting and deadline requirements.