AI Data Trainer / Model Evaluator (Freelance, Remote)
Evaluated AI-generated responses for accuracy, relevance, and safety to support RLHF training and model improvement. Ranked and analyzed model outputs to identify issues and guide preference learning. Performed quality assessment by detecting hallucinations, bias, and factual errors in response content. • Ranked outputs for RLHF training • Detected hallucinations, bias, and factual inaccuracies • Designed prompt tests for reasoning and instruction-following • Assessed responses for safety and overall quality