AI Response Evaluator & Content Quality Analyst (Remote Freelance)
Evaluated and compared AI-generated responses for quality across multiple criteria including clarity, factual accuracy, reasoning quality, tone, and practical usefulness. Ranked outputs for the same prompt, identified strengths and weaknesses, and produced structured written judgments aligned to provided guidelines. Designed evaluation prompts to test AI performance across scenarios and varying difficulty levels. • Assessed response quality dimensions (clarity, accuracy, reasoning, tone) • Compared multiple responses per prompt and selected ranked order • Provided structured written feedback explaining assessment decisions • Applied detailed rubric/guidelines consistently for precision