Data Quality & AI Evaluation Lead (Operations Lead & Data Evaluator) - FINDEM
Led AI data evaluation and quality operations by assessing system outputs and unstructured datasets against strict structured guidelines. Validated automated assessments and AI-driven pipelines, capturing reproducible error traces and flagging reasoning discrepancies prior to rollouts. Produced clear written justifications for quality dimensions to product and engineering teams to drive measurable improvements in error rates. • Evaluated outputs for factual consistency, logical soundness, and reasoning quality across 8-person team workflows. • Checked large unstructured datasets (8,000+ rows) and daily volumes of 2,000+ complex data points. • Tracked quality KPIs using Google Sheets to maintain adherence to evaluation standards. • Documented failure modes and reasoning discrepancies with reproducible evidence.