RLHF Generalist Writing and Reviewer of Model Responses (Mercor, Remote)
Evaluated, compared, and ranked AI model responses to user prompts in Portuguese and English, using criteria such as factual accuracy, instruction following, relevance, clarity, completeness, safety, and usefulness. Produced high-quality reference responses intended to support model training, evaluation, and alignment workflows across generalist, technical, scientific, and health-related contexts. Reviewed model outputs to identify hallucinations, unsupported claims, missing context, reasoning gaps, and safety issues, emphasizing evidence-grounded multilingual communication. • Ranked responses by quality and alignment with user intent. • Wrote structured written feedback to enable quality improvement of AI-generated content. • Ensured multilingual (Portuguese/English) quality and usefulness in evaluation outputs. • Applied editorial judgment and domain expertise in health and public health during reviews.