Avito ML Cup 2025 / Wink AI Challenge (project work)
Designed an automated structuring approach for digital scenes using a multimodal algorithm. Applied text, image, and metadata analysis to identify duplicate ads and produce structured outputs. Focused on reducing ambiguity by aligning extracted scene information with consistent representations. • Performed multimodal analysis combining text/image/metadata signals. • Identified duplicate advertisements and structured scene information. • Prepared outputs suitable for downstream ML training or evaluation. • Used competition-style iterative refinement to improve extraction quality.