Freelance AI Data Annotator & Content Reviewer (Remote) — AI Response Evaluation & Quality Scoring
Provided rubric-based evaluation of AI-generated responses for accuracy, relevance, clarity, and safety for LLM training datasets. Conducted comparisons across multiple outputs and ranked responses based on factual correctness, helpfulness, and user intent. • Evaluated and scored responses to support model training and dataset reliability • Produced quality feedback and improvement suggestions for unclear or inaccurate outputs • Documented reasoning behind ranking decisions using rubrics • Flagged inconsistencies and errors to improve overall dataset integrity