AI Tutor — high-complexity RLHF and SFT data/training evaluation for multimodal models
Served as an AI Tutor performing RLHF and SFT-oriented evaluation and training support for high-complexity tasks. Assessed generations for prompt adherence, factual accuracy, and overall response quality to maintain performance standards. Applied adversarial prompting strategies to surface model biases and vulnerabilities, including social engineering and prompt injection risks. • Evaluated prompt adherence and response quality. • Checked factual accuracy against expected behavior. • Produced and reviewed multimodal training inputs across multiple modalities. • Created adversarial prompts using psychological principles to test robustness.