AI Training & Systems Specialist (AI training, evaluation, and red teaming) at Uber Technologies Inc. (EXT).
Led red teaming and adversarial testing to identify LLM vulnerabilities and reduce edge-case failure rates for HRL-based AI products. Translated complex model and evaluation guidance into repeatable workflows and SOPs used for assessing instruction-following quality. Coordinated responsible AI prompt engineering for culture-sensitive use cases to improve alignment and reliability. • Conducted adversarial testing and purple teaming for model vulnerability discovery. • Developed SOPs for data evaluation workflows across diverse demographic and cultural contexts. • Evaluated fine-tuning outcomes for Indian languages (Bengali, Hindi, Indian English) using HRL-style assessment. • Managed cultural-based prompt engineering for the Nano Banana project and tracked alignment improvements.