AI Generalist Evaluator
As an AI Generalist Evaluator at Scale AI, I assessed and evaluated AI-generated voice responses for quality and accuracy. My tasks included comparing audio responses and verifying their naturalness against native English references. I also reviewed Hindi dubbed videos for translation accuracy and contextual alignment. • Compared AI-generated audio outputs for naturalness and fluency • Assessed speaker similarity, pronunciation, pacing, and intonation • Evaluated the accuracy of AI-generated dubbed videos • Analyzed prosody and potential audio quality degradation