AI Data Annotation & LLM Evaluation Specialist
Worked on AI-assisted systems and LLM evaluation workflows involving prompt engineering, response validation, semantic classification, and data quality review. Responsibilities included labeling conversational data, validating AI-generated outputs for accuracy and consistency, identifying hallucinations and edge cases, improving prompt quality, and structuring datasets for retrieval and semantic search systems. Also supported RAG-based workflows, embeddings evaluation, and AI automation pipelines while following strict quality assurance and annotation standards. Collaborated with engineering and product teams to improve model reliability, response relevance, and overall AI system performance.