Lead Data Scientist (AI/ML research and LLM evaluation)
Served as a Lead Data Scientist guiding AI/ML research that evaluates LLM-driven workflows against domain-specific quality requirements. Focused on assessing model outputs for accuracy, reasoning quality, and reliability, and translating findings into improved prompt strategies and team guidance. Designed and executed prompt engineering approaches for specialized scientific and technical domains. • Evaluated LLM outputs to meet accuracy and reasoning standards • Developed prompt engineering strategies for scientific/technical domains • Guided teams on adopting and evaluating LLM techniques • Presented research findings and contributed to ML best practices