Independent Technologist / Freelancer — AI automation and LLM response/coding evaluation
Performed LLM and coding output evaluations for correctness, reasoning quality, hallucination risk, security issues, and practical usefulness. Compared multiple AI model responses against task instructions and produced structured evaluation notes, quality ratings, and actionable improvement feedback. Reviewed AI-generated code for bugs, missing edge cases, maintainability problems, insecure patterns, and production-readiness concerns. • Evaluated instruction following, factual accuracy, clarity, completeness, safety, and user value • Ranked/compared outputs across ChatGPT, Claude Code, Gemini, Replit, Kimi, and agent-based systems • Wrote concise rationales and rubric-style feedback for AI training workflows • Applied cybersecurity-aware review thinking (including web/API behavior analysis) in authorized/lab contexts