Freelance AI Data Trainer (LLM Evaluator / Data Annotation Specialist) — Multiple Platforms (Scale AI, Remotasks, Appen)
Freelance AI Data Trainer performing LLM response evaluation and preference-style ranking for large language model outputs to improve overall quality and alignment. Assessed responses for factual accuracy, instruction adherence, coherence, and bias, and supported red-teaming activities to identify jailbreak and safety vulnerabilities. • Evaluated and ranked 10,000+ LLM responses for quality and correctness • Created prompts for supervised fine-tuning datasets (creative writing, Q&A, reasoning) • Conducted red-teaming to detect jailbreak vulnerabilities • Maintained 97%+ quality scores and flagged items for accuracy bonus pools