Prompt & Response Evaluator
Evaluated and ranked AI-generated responses across diverse prompts including creative writing, STEM, coding, and reasoning tasks. Rated outputs for helpfulness, accuracy, harmlessness, and stylistic quality using detailed rubrics. Wrote high-quality, diverse prompts to expand training datasets for large language models. Provided written rationales for preference judgments to guide model alignment. Maintained top-tier quality scores, qualifying for specialized high-pay task queues on platforms including Outlier and Aligner