AI Evaluation & Adversarial Testing (Freelance / Independent Contractor)
Conducts adversarial evaluation of large language models using variant-specific, multi-document prompt contexts. Probes for instruction-following weaknesses, safety-limit bypasses, and failure modes that can be induced by carefully designed prompts. Produces qualitative assessment outputs, including rubrics and written analysis, to distinguish genuine model failures from misleading “successful-looking” runs. • Designs and runs adversarial test cases for LLMs • Writes natural-language grading rubrics for evaluator-model rating • Analyzes outputs for instruction adherence and specific failure modes • Generates synthetic documents and test materials for evaluation scenarios