Freelance Language Quality Evaluator (Upwork / Appen / Clickworker)
Freelance Language Quality Evaluator performing large-scale AI response quality evaluation for language model training and conversational QA. Rated AI-generated English and Kiswahili responses for grammar, fluency, and factual consistency, then rewrote outputs to be linguistically accurate and culturally appropriate for Kenyan users. Conducted side-by-side preference ranking (A/B testing) to compare conversational model outputs and measure inter-annotator agreement in quality audits.• Review 200+ AI-generated text responses per week using grammar/fluency/factuality criteria. • Rewrite incorrect or unnatural outputs into appropriate Kenyan/East African versions. • Perform A/B preference ranking for conversational AI model outputs. • Achieve 95%+ inter-annotator agreement during quality audits.