Delivery Data Analyst | Turing — AI training/fine-tuning and evaluation work (LLMs, SFT, RLHF).
Worked on fine-tuning large language models to improve performance and capabilities using supervised fine-tuning methods. Conducted side-by-side evaluations and RLHF workflows to compare model behavior and align outputs with desired quality. Enhanced multi-modality capabilities and math-reasoning performance so models can process and generate across diverse formats and tasks. • Applied Supervised Fine-Tuning (SFT) to optimize accuracy and functionality. • Performed SxS evaluations and RLHF for comprehensive model comparison. • Developed enhancements for multi-modal processing and generation. • Built improvements for math reasoning tasks and computational accuracy.