AI Research Analyst & LLM Content Evaluator (AI trainer/generalist; LLM evaluation & testing)
Evaluated Large Language Model responses across multiple subject domains including science, mathematics, technology, and general knowledge using structured evaluation frameworks. Assessed outputs for reasoning errors, factual inaccuracies, and overall response quality while following detailed rubrics in high-volume asynchronous workflows. Produced clear, structured rationales documenting findings and maintaining evaluative integrity for ongoing content reviews. • Tested and rated model outputs using predefined criteria • Flagged logic and factual issues with evidence-based notes • Delivered structured written feedback in an asynchronous setting • Collaborated with distributed teams to document results