AI Trainer Skills: data labeling, quality rating, RLHF feedback
Conducted data labeling, cleaning, and RLHF-style feedback generation by reviewing model outputs and providing quality ratings. Performed critical evaluation of LLM logical consistency to create reliable supervision signals. Reviewed multilingual content to ensure annotation quality across English and Hindi inputs. • Labeled and cleaned data for training readiness • Provided RLHF feedback based on output quality • Evaluated logical consistency of LLM responses • Performed multilingual content review (English & Hindi)