LLM Technical Evaluator and AI Data Annotator
Responsible for LLM response evaluation, logical reasoning assessment, factual consistency checking, and RLHF feedback annotation on AI model outputs. Conducted high-precision text classification and technical entity extraction with strict quality standards. Performed standardized annotation, dialogue quality ranking, error correction, and quality inspection tasks across AI dialogue and creative writing. • Evaluated AI dialogue and creative writing outputs for literary, technical, and historical content accuracy. • Labeled and optimized technical scenario data for prompt validation, consistency, and correctness. • Conducted RLHF feedback annotation for AI training and prompt-response improvement. • Used Python and internal/proprietary tools for manual annotation, document reviewing, and dialogue testing.