Freelance/Contract AI Model Evaluation and Data Quality
As a freelance/contract AI Model Evaluation and Data Quality professional, I completed task-based evaluations across various platforms in domains such as math, code, telecommunications, and bilingual Chinese-English. My responsibilities included following client rubrics, performing preference labeling, and producing pairwise rankings, rewritten references, and error taxonomies for reviewer calibration. I generated clear, auditable rationales and met throughput and quality gates as defined by each program. • Adhered strictly to rubric-driven task guidelines • Delivered quality-assured evaluation outputs for LLM/ML models • Contributed reference, ranking, and error taxonomy data for model improvement • Regularly met or exceeded client-defined accuracy and completeness targets.