Freelance AI Trainer & Data Annotator (Independent / Remote)
Trained and fine-tuned large language models by creating high-quality labeled datasets and providing instructional feedback to improve model behavior. Evaluated AI-generated text for accuracy, tone, safety, and alignment with task instructions using RLHF (Reinforcement Learning from Human Feedback) methodologies. Produced consistent outputs under tight deadlines across multiple concurrent projects. • LLM evaluation for correctness, tone, and safety compliance • Instruction-following alignment checks against task rubrics • Prompt writing, refinement, and red-teaming across domains • Semantic annotation including entity recognition and sentiment classification