Freelance AI Evaluation Specialist (Remote)
Evaluated AI-generated responses to assess quality, relevance, and accuracy according to client requirements. Performed prompt rewriting and compared model responses to support consistent evaluation. Conducted dataset annotation and quality checks to reduce labeling errors and improve consistency across tasks. • Reviewed AI responses for correctness and relevance • Rewrote prompts and compared outputs between language models • Annotated datasets following detailed project guidelines • Performed quality assurance checks for consistency