AI Data Specialist — Goodnotes
Led multimodal annotation projects across text, image, audio, and video datasets to support AI model training and evaluation. Performed LLM response analysis and quality evaluations to improve reasoning, factual accuracy, and response alignment. Designed prompts and edge-case scenarios to stress-test AI systems and identify inconsistencies, hallucinations, and performance gaps. • Conducted multimodal annotation for training and evaluation datasets • Evaluated LLM outputs for reasoning quality and factual correctness • Built prompt and edge-case scenarios for robustness testing • Ran A/B testing to compare outputs and detect gaps