AI Generalist Contractor - Mercor Corporation
Testing and refining complex prompts to improve large language model generation, reasoning quality, and factual accuracy. Evaluating and rating AI outputs across diverse domains to ensure compliance with project rubrics, style guides, and safety protocols. Providing quality human feedback by ranking responses and drafting gold-standard targets for model alignment, tone, and logical consistency. • Developed and refined prompt strategies for LLM performance • Performed rubric-based evaluation, annotation, and output quality checks • Wrote gold-standard responses to guide model training • Collaborated with multidisciplinary AI training teams