Artificial Intelligence Engineer, AfterQuery (AI training/evaluation dataset work)
Designed and refined high-quality datasets for training and evaluating LLMs on technical reasoning and complex problem-solving tasks. Conducted rigorous evaluations of frontier AI models by identifying edge cases in model logic and applying RLHF-style techniques to improve safety and accuracy. Authored technical reports documenting assumptions, hyperparameters, and empirical findings to support reproducible research. • Dataset design and refinement for LLM training/evaluation • Model evaluation with edge-case analysis • RLHF-based improvements for model safety and accuracy • Reproducibility-focused reporting and documentation