AI Training / Response Evaluation (Contractor / Remote)
Evaluated AI-generated responses for quality, accuracy, relevance, and clarity using detailed rubrics and structured guidelines. Compared response pairs and rated individual outputs to produce preference data that supports model improvement. Wrote concise, well-reasoned justifications while maintaining consistent adherence to the guidelines across tasks. • Quality assessment using rubric criteria • Pairwise comparison and preference ratings • Justification writing for each judgment • Guideline compliance and quality assurance