AI Language Trainer & Data Contributor at Outlier AI / DataForce / Toloka (Jan 2022–Present)
Participate in RLHF and language model training programs by evaluating model outputs for multiple conversational quality criteria. Assess coherence, safety, factual correctness, and conversational quality, then support moderation-oriented dataset improvements. Complete text classification, ranking, prompt evaluation, and related data contribution tasks for training workflows. • RLHF-oriented output evaluation • Coherence, safety, and factual correctness checks • Text classification, ranking, and moderation tasks • Prompt evaluation and dataset contribution