Language Data Associate — Global AI Solutions (Data labeling for speech/linguistic datasets)
Performed verbatim transcription and quality checking on complex Swahili audio files for speech-recognition training. Reviewed and modified machine-generated audio segmentations to ensure linguistic accuracy and adherence to project-specific phonetic and grammatical guidelines. Refined transcripts to support model development with dialectal variation awareness and ambient noise filtering. • Transcribed Swahili audio with 99%+ accuracy while following phonetic and grammatical rules • Audited audio segmentations and corrected them for correct spoken-utterance boundaries • Supported dataset readiness for advanced speech-recognition model training • Met and exceeded high-volume productivity targets without compromising quality scores