AI response evaluator
Evaluated AI-generated responses for accuracy, reasoning quality, factual consistency, completeness, and adherence to instructions. Applied structured evaluation guidelines to assess strengths, weaknesses, and potential errors in model outputs. Produced detailed written rationales supporting evaluation decisions and contributed feedback used to improve AI model performance.