DataAnnotation (Contract/Freelance) — AI response evaluation and LLM quality review
Evaluated AI-generated responses for accuracy, relevance, clarity, and instruction-following using detailed evaluation guidelines. Performed prompt testing and comparative response analysis to assess output quality and detect issues. Identified factual inconsistencies, logical errors, and other response quality problems during LLM quality review. • Accuracy and factuality checks against instruction context • Relevance, clarity, and coherence scoring • Comparative evaluation across prompt/response variations • Detection and reporting of inconsistencies and logical issues