Freelance AI Training & Data Annotation Specialist (Remote)
Contributed human feedback for RLHF pipelines by rating and ranking AI-generated responses across accuracy, tone, helpfulness, and safety dimensions. Crafted and tested prompts to probe model behavior and surface edge cases for iterative improvement. Participated in red-teaming and adversarial testing workflows to improve model robustness. • Produced structured feedback signals for reinforcement learning from human feedback. • Evaluated and ranked model outputs using multiple quality dimensions. • Performed prompt engineering and adversarial testing to identify weaknesses. • Supported iterative cycles aligned with project QA and review guidelines.