AI Training & LLM Evaluation Specialist (Public-Sector AI Business Orchestration)
Evaluated and reviewed LLM and AI-generated outputs in Chinese for workflow correctness, risk-control logic, and user intent alignment. Applied rubric-based QA to judge the quality of AI-assisted business orchestration outputs in public-sector smart community implementations. Ensured structured and accurate responses from LLMs by validating against operational and acceptance-quality standards. • Extensive experience reviewing Chinese domain-specific LLM outputs. • Focused on workflow logic, intent, and business-acceptance criteria. • Participated in prompt iteration and guideline-based evaluation. • Conducted quality review of AI model responses for smart community scenarios.