WeAreDevelopers LIVE Sep 18, 2024

Vision for Websites: Training Your Frontend to See

Daniel Madalitso Phiri

Ditch rigid keyword metadata and teach your frontend to see. Use multimodal AI and vector databases to build context-aware apps that intuitively understand images, text, and audio.

Pause
Mute Enter Fullscreen
#1 about 2 min

Defining machine vision for modern web frontends

Redefining digital vision as data deduction provides clear strategies for frontend data interpretation.

#2 about 5 min

Demonstrating multimodal search in an enterprise storefront

Retrieving catalog items without specific metadata requires multimodality to dynamically match text and visual queries.

#3 about 5 min

Improving user interactions via multimodal context gathering

Transitioning traditional keyword searches into natural multimodal queries significantly improves user interface interactions.

#4 about 4 min

Encapsulating complex frontend data using embedding models

Storing distinct multi-format data in multidimensional mathematical spaces enables the direct comparison of non-uniform assets.

#5 about 5 min

Executing vector search queries using spatial distance

Plotting queries and data into numbered vector coordinates measures physical distance to determine search relevance.

#6 about 3 min

Unifying distinct media formats across shared vector spaces

Processing varying media through specialized encoders deposits uniform embeddings into a shared retrieval environment.

#7 about 3 min

Architecting a multimodal storefront interface using Next.js

Wiring frontend UI components to remote API routes securely hands text and image queries off to backend machine learning tools.

#8 about 7 min

Filtering text search queries with TypeScript and Weaviate

Interrogating vector clusters with text values relies on dynamic API limits to trim results by statistical distance jumps.

#9 about 3 min

Processing base64 image queries against remote vector collections

Submitting user photos to backend machine learning functions requires encoding visuals into processable base64 strings.

#10 about 3 min

Expanding vision applications beyond standard ecommerce features

Deploying camera-based cross-referencing inside user applications bridges digital product catalogs with real-world physical objects.

Matching moments

5:20 min

Building neural search applications across diverse data modalities

Han Xiao · WWC 2022

3:46 min

Substituting traditional classification models with search-based AI architecture

Erik Bamberg · LIVE

3:00 min

Introduction to generative AI and vector search

Mary Grygleski Mary Grygleski · LIVE

1:28 min

Implementing multimodal image processing and visual capabilities on the edge

Daniel Ostrovsky Daniel Ostrovsky · WWC Europe 2026

3:45 min

Demonstrating Viro React capabilities for interactive applications

Vladimir Novick · WWC 2021

4:46 min

Visualizing semantic similarity within a multi-dimensional vector space

Erik Bamberg · LIVE

Upcoming sessions on this topic

Open session

World Congress 2026 North America

Agentic commerce's dirty little secret, and what to do about it.

Joe Monastiero

Founder & CEO at visualAI

Joe Monastiero
Open session

World Congress 2026 North America

Small LLM in your Browser: Huge Opportunities for Web Applications

Daniel Ostrovsky

UI/UX Architect at Payoneer | AI Architect | Full Cycle Development Expert | Public Speaker | Open Source Contributor |

Daniel Ostrovsky
Open session

World Congress 2026 North America

Building Stuff with GenAI - The Open Minded Workshop beyond OpenAI

Andreas Erben

CTO for Applied AI and Metaverse at daenet

Andreas Erben
Open session

World Congress 2026 North America

Making Science Larger, not just Faster

Yuval Dvir

Commercial Executive, SandboxAQ

Yuval Dvir
Open session

World Congress 2026 North America

Engineering the Pivot: How Creative Strategy Solves the Hard Problems of AI Accuracy and Scale

Shruti Tiwari

AI/ML product manager, Dell

Shruti Tiwari
Open session

World Congress 2026 North America

Vibe Coding Accessibility

Karl Groves

Focused on actively fixing accessibility

Karl Groves