AI Training & Evaluation (LLM response evaluation, prompt evaluation, response ranking, annotation and QA review)
Engaged in bilingual AI training and evaluation tasks emphasizing prompt/response quality checking and instruction-following assessment. Conducted factuality checking and reasoning verification during LLM response evaluation and ranking. Completed data annotation and QA review aligned with detailed labeling guidelines for consistent outputs. • Evaluated prompt quality and adherence to instructions • Compared and ranked model responses for quality • Performed factuality and reasoning verification • Applied bilingual Chinese-English evaluation and quality review