AI Data Annotation Specialist | OneForma (Remote)
Performed evaluation of AI-generated responses for accuracy, relevance, safety, and helpfulness across LLM and search evaluation projects. Conducted search relevance rating and query evaluation to judge output quality against guidelines. Ensured consistent scoring and documentation while collaborating with QA teams. • Rated responses for relevance and helpfulness • Checked safety and accuracy against rubrics • Completed search relevance and query evaluation tasks • Coordinated with QA to resolve annotation inconsistencies