AI Evaluation & Applied AI Projects (AI response evaluation and labeling/QA feedback), 2022 - Present
Provided AI response evaluation for multiple Chinese-language and content-generation scenarios, focusing on correctness, usefulness, fluency, and task compliance. Reviewed semantic accuracy, readability, cultural context, and annotation consistency for Chinese outputs, and compared model behavior against expected instruction-following. Authored structured QA feedback capturing edge cases, failure patterns, user experience issues, and rubric ideas for scoring consistency. • Evaluated AI-assisted speaking assessment outputs and pronunciation/scoring feedback quality • Validated Chinese reading and classical text related outputs for semantic nuance and rare-character support • Checked template-based poster/content generation results for output quality and compliance • Produced rubric-based and edge-case documentation to guide further AI training/evaluation