Contractor (Data Labeling) — HandshakeAI
Produced high-quality training and evaluation data for frontier large language models by writing domain-specific prompts and assessing model responses. Applied detailed annotation guidelines across multiple subject areas to ensure consistent labeling quality. Contributed to downstream model improvement by creating structured data suitable for AI training and evaluation pipelines. • Wrote domain-specific prompts and evaluated corresponding model outputs • Followed detailed annotation guidelines for labeling consistency • Supported training/evaluation dataset creation across multiple subjects • Ensured quality of labeled outputs for LLM readiness