Founder & AI Systems Researcher (LLM Evaluation & AI Output Auditing)
As Founder & AI Systems Researcher at VitalSearch, led the design, evaluation, and deployment of production-grade agentic AI systems used for structured output validation and auditing. Developed and applied systematic workflows to evaluate LLM outputs for accuracy, reasoning quality, and failure mode identification, used in real-time decision support contexts. Published peer-reviewed research on AI output auditing and contributed directly to RLHF and fairness training data pipelines. • Designed and conducted structured model evaluation for LLMs, including output accuracy and traceability. • Built and deployed evaluation frameworks used in live AI training and auditing systems. • Developed protocols for output provenance and systematic inconsistency detection. • Led research-integrated labeling tasks validated in peer-reviewed venues.