AI Model Evaluation Specialist (Freelance / Remote)
Evaluated AI-generated responses for factual accuracy, clarity, and contextual relevance as part of an AI model assessment process. Provided structured, actionable feedback to improve model reasoning, performance, and usability. Assessed outputs by simulating real-world user interactions and reviewing for subtle inconsistencies, patterns, and edge-case quality gaps. • Rated and reviewed response quality against evaluation guidelines. • Flagged anomalies, inconsistencies, and nuanced output issues. • Produced detailed feedback intended for model improvement. • Maintained data integrity and strict QA standards during evaluations.