WeAreDevelopers LIVE • Sep 18, 2024

Vision for Websites: Training Your Frontend to See

Daniel Madalitso Phiri

Ditch rigid keyword metadata and teach your frontend to see. Use multimodal AI and vector databases to build context-aware apps that intuitively understand images, text, and audio.

Pause
Mute Enter Fullscreen
#1 about 2 min

Defining machine vision for modern web frontends

Redefining digital vision as data deduction provides clear strategies for frontend data interpretation.

#2 about 5 min

Demonstrating multimodal search in an enterprise storefront

Retrieving catalog items without specific metadata requires multimodality to dynamically match text and visual queries.

#3 about 5 min

Improving user interactions via multimodal context gathering

Transitioning traditional keyword searches into natural multimodal queries significantly improves user interface interactions.

#4 about 4 min

Encapsulating complex frontend data using embedding models

Storing distinct multi-format data in multidimensional mathematical spaces enables the direct comparison of non-uniform assets.

#5 about 5 min

Executing vector search queries using spatial distance

Plotting queries and data into numbered vector coordinates measures physical distance to determine search relevance.

#6 about 3 min

Unifying distinct media formats across shared vector spaces

Processing varying media through specialized encoders deposits uniform embeddings into a shared retrieval environment.

#7 about 3 min

Architecting a multimodal storefront interface using Next.js

Wiring frontend UI components to remote API routes securely hands text and image queries off to backend machine learning tools.

#8 about 7 min

Filtering text search queries with TypeScript and Weaviate

Interrogating vector clusters with text values relies on dynamic API limits to trim results by statistical distance jumps.

#9 about 3 min

Processing base64 image queries against remote vector collections

Submitting user photos to backend machine learning functions requires encoding visuals into processable base64 strings.

#10 about 3 min

Expanding vision applications beyond standard ecommerce features

Deploying camera-based cross-referencing inside user applications bridges digital product catalogs with real-world physical objects.

Matching moments

5:20 min

Building neural search applications across diverse data modalities

Han Xiao · World Congress 2022

3:46 min

Substituting traditional classification models with search-based AI architecture

Erik Bamberg · LIVE

3:00 min

Introduction to generative AI and vector search

Mary Grygleski Mary Grygleski · LIVE

1:28 min

Implementing multimodal image processing and visual capabilities on the edge

Daniel Ostrovsky Daniel Ostrovsky · World Congress 2026 Europe

3:45 min

Demonstrating Viro React capabilities for interactive applications

Vladimir Novick · World Congress 2021

4:46 min

Visualizing semantic similarity within a multi-dimensional vector space

Erik Bamberg · LIVE