AI Model Output Evaluator, Outlier AI / Scale AI (Remote)
Screen and qualify as a generalist evaluator for English language comprehension, composition, and advanced reading analysis within AI response assessment tasks. Evaluate AI-generated responses for quality, accuracy, and instruction-following using structured assessment frameworks. Provide ratings to support model evaluation and downstream quality improvements. • Assess instruction-following and response quality • Judge accuracy and reading/comprehension alignment • Apply structured assessment frameworks for consistency • Support dataset/model quality evaluation through ratings