For employers

Hire this AI Trainer

Sign in or create an account to invite AI Trainers to your job.

Invite to Job
B
Benith M.

Benith M.

AI Training & Content Evaluation Specialist — Invisible Technologies

Spain flagBarcelona, Spain

Key Skills

Software

Don't disclose
Micro1
MercorMercor
Scale AIScale AI

Top Subject Matter

AI response evaluation for LLM training (multilingual reasoning/safety/instruction-following)
LLM evaluation and AI output revision (support/business tasks)
Generalist/multilingual LLM evaluation (factuality and reasoning)

Top Data Types

TextText
DocumentDocument

Top Task Types

ClassificationClassification
Text GenerationText Generation
Question AnsweringQuestion Answering
Text SummarizationText Summarization
RLHFRLHF
Red TeamingRed Teaming

Freelancer Overview

AI Training & Content Evaluation Specialist — Invisible Technologies. Brings 1+ years of professional experience across legal operations, contract review, compliance, and structured analysis. Core strengths include Don't disclose, Micro1, and Mercor. Education includes Bachelor of Business Administration, University of Derby (2020) and Bachelor of Business Administration, Excella School (2020). AI-training focus includes data types such as Text and labeling workflows including Evaluation, Rating, and Prompt-Response Writing.

Labeling Experience

AI Training & Content Evaluation Specialist — Invisible Technologies

Don't discloseTextText

Evaluated 15,000+ AI-generated responses for reasoning, safety, and instruction-following quality. Performed rubric-based assessment and maintained 95%+ agreement with reviewer benchmarks while comparing outputs to select the most accurate, safe, and context-appropriate responses. • Rated responses against quality criteria including accuracy, reasoning quality, safety, and policy compliance • Conducted model output comparisons to identify best-performing answers • Reviewed generated text and translations for quality, correctness, and guideline compliance • Completed annotation, moderation, and QA checks for AI training pipelines

2026 - Present
Scale AI

LLM Evaluation Specialist - Micro1

Scale AIScale AITextText

Performed LLM evaluation for reasoning, safety, accuracy, clarity, and policy compliance across support and business-oriented prompts. Conducted rubric-based reviews, prompt-response analysis, and failure detection to identify issues for model improvement. Rewrote and refined AI outputs to enhance structure, usability, and real-world performance. • Evaluated 500+ AI responses while maintaining 95%+ agreement with reviewer benchmarks. • Applied rubric-based scoring to assess quality, reasoning, and policy adherence. • Identified hallucinations, inconsistencies, and edge cases affecting reliability. • Rewrote AI outputs to improve quality, structure, and user-facing usability.

2026 - 2026
Mercor

Generalist Expert — Mercor

MercorMercorTextText

Completed AI evaluation and reasoning tasks that involved response comparison and factuality checks. Reviewed AI-generated outputs using guideline-based evaluation frameworks, including analysis informed by screenshot and UI workflow context. • Compared multiple responses and selected outputs based on quality and correctness • Performed factuality checks and structured analysis for reasoning quality • Assessed writing quality, instruction following, and overall response effectiveness • Evaluated generalist and multilingual AI responses for accuracy and consistency

2026 - 2026

AI Trainer & LLM Evaluation Specialist — Micro1

Micro1TextText

Evaluated 500+ AI-generated responses focused on accuracy, clarity, reasoning, safety, and instruction-following in customer support and business contexts. Used rubric-based reviews and prompt-response analysis while maintaining 95%+ agreement with reviewer benchmarks for policy compliance. • Performed rubric-based scoring of prompt-response pairs and reviewed output quality • Conducted failure detection to identify errors and edge cases • Rewrote AI outputs to improve structure, quality, and real-world usability • Flagged hallucinations, inconsistencies, and policy-relevant issues for model improvement

2026 - 2026

Education

E

EU Business School

Bachelor of Business Administration, Business Administration

Bachelor of Business Administration
2023 - 2025
E

Excella School

Bachelor of Business Administration, Business Administration

Bachelor of Business Administration
2018 - 2020

Work History

I

Invisible Technologies

AI Content Evaluation Specialist

Barcelona
2026 - Present
M

Mercor

Generalist AI Evaluation Specialist

N/A
2026 - 2026