Bilingual AI Evaluator / Cybersecurity-focused LLM Reviewer (academic AI evaluation and QA practice)
Conducted rubric-based evaluation of LLM outputs, focusing on correctness, relevance, completeness, tone, safety, and adherence to instructions. Performed bilingual Chinese-English review to verify meaning, fluency, terminology consistency, and instruction compliance while comparing responses to user intent. Produced clear evaluation notes and concise evidence-based judgments to support consistent reviewer alignment. • Rubric-based scoring and quality assurance checks for LLM responses • Identification of unsupported claims, ambiguity, and missing safety/technical caveats • Privacy risk assessment and prompt-injection / social-engineering risk flagging • Clear annotation writing for reviewer alignment and decision traceability