AI Training Specialist – Mercor / Alignerr (SFT data creation and rubric-based response writing)
Delivered supervised fine-tuning (SFT) work by producing reasoning-heavy training data for frontier LLMs. Designed multi-turn dialogue scaffolds and adversarial prompts to probe logic and chain-of-thought (CoT) behavior. Authored and maintained high-fidelity model responses that satisfy strict technical and rubric-based quality requirements. • Executed multiple high-priority SFT projects concurrently. • Stress-tested model reasoning with adversarial prompts and dialogue structures. • Authored gold-standard responses meeting technical and creative rubrics. • Maintained consistent quality across concurrent gold-standard outputs.