Freelance AI Trainer | Outlier.ai, Remote (Prompt Engineering & RLHF Evaluation)
Freelance AI Trainer at Outlier.ai supporting LLM training via human feedback evaluation. The role focuses on assessing AI-generated answers for correctness, reasoning quality, tone, coherence, and task alignment. It also includes identifying and annotating model failure modes to provide improvement signals for subsequent training. • Prompt + response writing for instruction and education/learning domains • RLHF response ranking and rating with feedback • Annotation of hallucinations, logical inconsistencies, ambiguity, and instruction-following failures • Evaluation against task intent using structured quality criteria