AI Data Trainer (RLHF/SFT Generalist)
Trained and evaluated LLM responses using rubric guidelines. Wrote prompts and performed fact-checking on model outputs to ensure accuracy. Ranked alternative responses based on quality and compliance with instructions. • Followed rubric guidelines for model training. • Wrote prompts for training/evaluation. • Fact-checked responses for correctness. • Ranked outputs for preference signals.