Freelance AI Data Trainer & Evaluator (Adversarial Red Teaming)
Executed adversarial red teaming to identify LLM vulnerabilities, edge cases, hallucination patterns, and potential safety policy violations. Designed complex prompts and multi-turn test scenarios to probe reasoning robustness across multiple domains. Rewrote and critiqued model outputs to establish higher-quality training baselines and mitigate failure modes. • Built adversarial prompts to stress-test reasoning and constraints • Simulated multi-turn dialogues to surface risky behaviors • Assessed outputs for hallucinations and policy issues • Critiqued and rewrote outputs for training-ready baselines