For employers

Hire this AI Trainer

Sign in or create an account to invite AI Trainers to your job.

Invite to Job
E
Efer T.

Efer T.

AI Evaluation and Data Curation Specialist – Remotask & Outlier (2018–2022)

United States Minor Outlying Islands flagsazburg, United States Minor Outlying Islands

Key Skills

Software

RemotasksRemotasks
Other

Top Subject Matter

AI and NLP evaluation
data curation
and LLM performance assessment

Top Data Types

TextText
DocumentDocument

Top Task Types

PolygonPolygon
Data CollectionData Collection
Computer Programming/CodingComputer Programming/Coding
Function CallingFunction Calling
Prompt + Response Writing (SFT)Prompt + Response Writing (SFT)
TranscriptionTranscription
Evaluation/RatingEvaluation/Rating
Red TeamingRed Teaming
RLHFRLHF
Text SummarizationText Summarization
Text GenerationText Generation
PolylinePolyline
Entity (NER) ClassificationEntity (NER) Classification
Point/Key PointPoint/Key Point
SegmentationSegmentation
ClassificationClassification
CuboidCuboid
Bounding BoxBounding Box
Fine-tuningFine-tuning
Question AnsweringQuestion Answering
Object DetectionObject Detection

Freelancer Overview

AI Evaluation and Data Curation Specialist – Remotask & Outlier (2018–2022). Brings 9+ years of professional experience across complex professional workflows, research, and quality-focused execution. Core strengths include Remotasks and Other. Education includes Master’s in Data Science, Boston University and Bachelor’s in Mathematics and Computer Science, Stamford Bridge Institute. AI-training focus includes data types such as Text and labeling workflows including Evaluation and Rating.

Labeling Experience

Data Science Subject Matter Expert – GenAI Research Projects (2020–Present)

OtherTextText

Designed and implemented scalable data collection and evaluation workflows for Generative AI research to support LLM training and evaluation. Created original, high-quality datasets and domain problems, then conducted rigorous fact-checking and bias analysis to ensure data integrity. Collaborated with GenAI researchers and engineers to translate research objectives into measurable requirements and repeatable data operations. • Defined data requirements and success metrics for LLM training. • Built scalable data collection and evaluation workflows aligned to research goals. • Performed fact-checking and bias analysis to maintain accuracy and fairness. • Improved throughput, quality, and reproducibility through workflow optimization.

2020 - Present
Remotasks

AI Evaluation and Data Curation Specialist – Remotask & Outlier (2018–2022)

RemotasksRemotasksTextText

Executed data annotation, validation, and evaluation tasks for AI and NLP systems using structured quality checks. Developed evaluation frameworks to assess LLM performance and factual consistency for downstream training and testing. Applied prompt engineering to refine AI-generated outputs and improve reliability while enforcing ethical handling and fairness standards. • Annotated and validated AI/NLP outputs for quality control. • Built structured rubric-based evaluation frameworks for LLM factuality. • Used prompt engineering to improve reliability of generated responses. • Ensured compliance with AI fairness, transparency, and ethical data handling requirements.

2018 - 2022

Education

S

Stamford Bridge Institute

Bachelor’s in Mathematics and Computer Science, Mathematics and Computer Science

Bachelor’s in Mathematics and Computer Science
Not specified
B

Boston University

Master’s in Data Science, Data Science

Master’s in Data Science
Not specified

Work History

G

GenAI Research Projects

Data Science Subject Matter Expert (GenAI Research Data & Evaluation)

San Francisco
2020 - Present
R

Remotask

AI Evaluation and Data Curation Specialist

San Francisco
2018 - 2022