AI Trainer & Evaluator — VLM (Micro1)
Evaluated multimodal (audio + video) outputs across several evaluation dimensions as part of VLM training and assessment. Participated in creating and refining annotation guidelines and used review and adjudication to improve inter-annotator consistency. Conducted A/B testing and quality assurance to support reliable comparisons of model outputs. • Multimodal evaluation across defined axes • Guideline contribution and annotator adjudication • A/B testing for model output comparison • Quality assurance and consistency checks