AI Training Contributor (RLHF & Data Quality)
For the past year, I participated in AI model training projects, focusing on enhancing large language model performance. My tasks included RLHF evaluation and dataset enrichment to improve model reasoning and response quality. I reviewed model outputs for factual accuracy and adherence to complex prompts. • Engaged in reinforcement learning from human feedback (RLHF) evaluation and prompt response rating. • Enhanced dataset quality by identifying and enriching weak areas in content and logical structure. • Applied domain expertise in financial literacy to ensure data relevance and instructional clarity. • Used generative AI platforms for prompt testing and model fine-tuning evaluations.