Data Labeling & Annotation Specialist — Viswam AI (Applied AI Team) (May 2025 – Present)
Curated, manually annotated, and preprocessed 100K+ Indic-language text samples, applying deduplication and quality control to improve downstream model performance. Developed standardized labeling guidelines to ensure consistent annotations across a multi-annotator team. Conducted RLHF evaluation by assessing GPT-style decoder model outputs and providing detailed feedback aligned to human preferences. • Curated 100K+ Indic text samples with quality assurance and deduplication. • Built and rolled out standardized annotation guidelines for team consistency. • Performed RLHF evaluation for GPT-style decoder responses using human preference alignment. • Maintained dataset versioning and logged data quality metrics for traceability using experiment tracking.