AI Interaction Evaluator - DataAnnotation
Worked with Codex and Claude Code CLI to evaluate AI-generated code, verify correctness, and analyze model rea soning across Python and software engineering tasks. Created test scenarios, identified failure cases, and provided structured feedback to improve AI model accuracy and coding performance.