AI Evaluation and Bilingual Assessment Practice (Bilingual AI response quality assessment & translation/localization checking)
Completed bilingual assessment tasks requiring side-by-side comparison of English and Chinese responses, identifying factual inaccuracies, unsupported claims, and instruction-following issues. Evaluated response quality based on clarity, accuracy, natural language use, reasoning quality, and whether the answer satisfied explicit and implicit user instructions. Produced translation- and localization-aware judgments to ensure culturally appropriate and natural Traditional Chinese (Taiwan) output. • Compared AI responses in English vs. Chinese for quality and compliance • Rated/assessed factual accuracy and clarity • Checked instruction following (explicit and implicit) • Reviewed translation quality and naturalness for localization