AI Model Trainer (LLM Evaluation) • Freelance/Contract (Remote)
Worked as an LLM evaluation and model trainer performing quality assessment of large language model outputs. Annotated and validated structured examples to identify failure cases, edge conditions, and areas needing improvement for robustness. Delivered prompt design and evaluation feedback to improve contextual relevance and reasoning quality across diverse scenarios. • Evaluated LLM outputs for accuracy, reasoning, and contextual relevance. • Designed and validated prompts to improve response quality. • Identified failure cases and edge conditions for robustness improvements. • Performed structured data annotation and quality validation for AI training pipelines.