Freelance Data Scientist – AI Training (Scale AI / Outlier)
Performed AI training and evaluation work by debugging LLM behavior and improving parsing performance. Used Chain-of-Thought prompting to train Gemini with multi-step reasoning, optimizing response quality and efficiency. Measured impact through reductions in response error rate and redundant API calls while improving parsing accuracy and overall response efficiency. • Debugging framework for LLM inefficiencies and logic errors • Chain-of-Thought prompting for Gemini multi-step reasoning • Parsing of user requests to improve downstream accuracy • Evaluation metrics: error-rate reduction, redundancy reduction, efficiency and accuracy gains