Bilingual AI Data Annotation QA Specialist | Freelance / Remote
This role involved evaluating AI-generated responses for accuracy, relevance, and completeness in both English and Chinese. Responsibilities included comparing outputs using structured rubrics and providing concise evaluation rationales. Data quality checks for label consistency, formatting issues, and guideline compliance were also conducted. • Conducted structured evaluation of LLM model responses. • Compared prompt-response pairs for intent alignment and localization. • Identified hallucinations and unsupported claims within outputs. • Performed data annotation QA and error analysis in text data.