Senior AI Training Specialist & Core Code Evaluator
Reviewed and evaluated large-language-model outputs to detect programming logic errors and semantic syntax constraint issues. Authored structured adversarial test criteria and edge cases to isolate hallucinations and strengthen safety guardrails. Improved validation and training accuracy metrics through systematic dataset and prompt quality auditing. • Annotated and corrected model-generated responses for logic, semantics, and constraint adherence. • Designed test cases to stress model failure modes and verify guardrail behavior. • Authored instruction datasets and logical prompts for distributed evaluation/training. • Conducted iterative quality review to raise validation training accuracy metrics.