Advanced AI code evaluator
Evaluated and red-teamed multi-language code generation models including Python, C++, Java, and TypeScript for accuracy, safety compliance, and syntactic efficiency. Conducted chain-of-thought logic verification, written complex instruction prompts, and graded algorithmic reasoning outputs to optimize core model alignment.