AI Trainer (Contract) at Abaka AI
Evaluated AI-generated outputs using standardized, multi-dimensional scoring rubrics to ensure high-quality model performance. Applied predefined guidelines to assess, compare, and rank multimodal outputs for quality and alignment. Validated structured outputs for correctness, schema integrity, and business logic compliance. • Performed preference ranking and output optimization for Generative AI systems • Documented edge cases and failure patterns and developed multiple-choice evaluation datasets • Conducted regression testing by simulating real-world workflows • Identified instruction conflicts, inconsistencies, and model errors to improve datasets and performance