Senior AI Data Trainer & Quality Auditor
I conducted advanced Reinforcement Learning from Human Feedback(RLHF) and multi-turn adversarial prompting to stress-test Large Language Models. Audited peer annotations for quality control, ensuring strict compliance with complex project taxonomies and safety guidelines. Specialized in generating high-quality ground-truth datasets for logical reasoning and factual accuracy validation.