AI/ML Quality Engineer – NLP & ASR Evaluation (Remote)
Evaluated NLP and ASR model outputs for accuracy, fluency, and intent alignment. Designed annotation guidelines to improve labeling consistency across evaluators and contributors. Conducted error analysis to identify model weaknesses and inform performance improvements. • Reviewed outputs and assessed quality against defined criteria • Created or refined labeling/annotation guidelines to reduce variance • Performed systematic error analysis on failure cases • Fed findings back to improve dataset and model performance