Freelance AI Data Trainer & Content Evaluator — Outlier AI (Remote)
Freelance AI data training and evaluation work generating English training samples and assessing LLM outputs for quality. You scored and ranked responses by accuracy, fluency, helpfulness, and safety, and submitted feedback to refine annotation guidelines. The work contributed data directly into RLHF-style pipelines for fine-tuning and alignment of large language models. • Generated open-ended prompts, multi-turn dialogue pairs, and instructional text • Evaluated outputs using quality rubrics across multiple dimensions • Flagged ambiguous, harmful, or low-quality responses with structured reports • Produced 500+ evaluated tasks per month exceeding platform benchmarks