AI Training / Content Evaluation (Freelance) — Remote
Reviewed AI-generated responses using rubrics to assess accuracy, clarity, and safety requirements. Performed ranking and comparison tasks to generate model preference or preference-related data. Flagged potential policy violations and recorded structured decisions for traceability and quality assurance. • Evaluated response quality against guidelines and rubric criteria • Documented safety and policy compliance judgments in structured fields • Conducted ranking/comparison work to drive preference data • Maintained accuracy and consistency across repeated guideline-based evaluations