I have experience evaluating AI-generated responses using detailed rubrics and annotation guidelines
I have experience evaluating AI-generated responses using detailed rubrics and annotation guidelines. In this role, I assessed outputs for accuracy, relevance, completeness, instruction-following, and safety, documented quality issues, and provided structured feedback to improve model performance. I also reviewed labeled data for consistency and adherence to guidelines, helping maintain high-quality datasets used for AI training and evaluation.