AI Training & Content Evaluation Specialist — Invisible Technologies
Evaluated 15,000+ AI-generated responses for reasoning, safety, and instruction-following quality. Performed rubric-based assessment and maintained 95%+ agreement with reviewer benchmarks while comparing outputs to select the most accurate, safe, and context-appropriate responses. • Rated responses against quality criteria including accuracy, reasoning quality, safety, and policy compliance • Conducted model output comparisons to identify best-performing answers • Reviewed generated text and translations for quality, correctness, and guideline compliance • Completed annotation, moderation, and QA checks for AI training pipelines