Audio Diarization and transcription
This is a large data project designed to improve voice recognition models or regional accents and dialects. The work involves cutting long audio recordings into short, timestamped segments based on who is speaking. The project focuses on separating overlapping voices, identifying different speakers and removing background noise.