Multilingual AI Transcript Evaluation & QA (Medical + General)
Evaluate and quality-assure AI-generated transcripts across general and medical content, assessing accuracy, faithfulness to source audio, terminology correctness, and fluency of model output. I work with Polish (my native language), applying rigorous, detail-level linguistic review and consistent application of project guidelines. Beyond pass/fail scoring, I flag systematic model error patterns, recurring mistranscriptions, terminology drift, and domain-specific accuracy issues, particularly in medical content where precision is critical.