Outlier AI — Finance Domain Specialist (LLM output review and evaluation)
Reviewed and evaluated large language model outputs focused on financial reasoning and answer quality. Scored accuracy and logic against professional standards to help improve model performance. Identified and helped address a systematic scoring inconsistency affecting financial responses. • Assessed financial reasoning quality, correctness, and logical consistency • Provided scores and feedback aligned to professional standards • Proposed guidance corrections that were adopted into platform-wide reviewer instructions • Worked across increasingly difficult finance workstreams on the platform