AI Integration Builder & Prompt Developer (O= Independent Venture)
Evaluated and refined LLM outputs by comparing prompt variants, identifying edge cases, and adjusting instructions for consistent behavior. Produced multilingual AI content and assessed tone, accuracy, and cultural fit across English, German, and Portuguese. Documented model failure modes and prompt changes to support reproducibility and iterative quality improvement. • Data work included preference-ranking style comparisons and RLHF-adjacent feedback workflows • LLM evaluation focused on factual accuracy, register, and cultural appropriateness • Iteration included prompt testing, output comparison, and failure-mode mitigation • Generated structured responses for a guest-assistant workflow using multi-step prompting