Freelance RLHF Response Ranking & Prompt Evaluation
Contributed to RLHF-style response ranking and evaluation for AI-generated outputs. Rated responses for quality, accuracy, relevance, and safety, supporting downstream model improvement workflows. Engineered and tested prompts for LLM behavior verification across multiple scenarios. • RLHF response ranking • Prompt engineering and testing • Quality scoring with rationales • Safety and guideline compliance checks