World Congress 2026 Europe - Virtual Stage Jul 2, 2026 Session details

Building an AI-Ready Content Lake: Scaling RAG and Document AI Beyond Demos

Angel Borroy

Are disconnected documents bottlenecking your enterprise AI? Discover how an open-source, on-premise content lake scales RAG into production while strictly enforcing native access controls.

Pause
Mute Enter Fullscreen
#1 about 3 min

Overcoming fragmented semantic searches in enterprise document storage

Centralizing search indexing overcomes the limitations of siloed corporate repositories and purely keyword-based traditional search algorithms.

#2 about 4 min

Designing an on-premise document search system with data sovereignty

A permission-aware architecture provides multi-tenant semantic search without exposing sensitive enterprise data to external cloud solutions.

#3 about 5 min

Architectural components for metadata extraction and knowledge discovery

Utilizing non-relational databases and block storage extracts essential metadata to support deep text embedding and internal knowledge discovery.

#4 about 5 min

Creating robust continuous ingestion connectors for localized document sources

Implementing structured connectivity interfaces enables scheduled batch background operations and live synchronization of diverse content formats.

#5 about 3 min

Managing asynchronous metadata syncing and document chunking workflows

Separating fundamental record copying from computationally expensive asynchronous document chunking workflows protects overall application operational stability.

#6 about 3 min

Navigating graphical memory limitations and container deployment configuration

Configuring dynamic physical swap allocations and strict local container controls mitigates sudden inference failures caused by graphical hardware limitations.

#7 about 2 min

Utilizing asymmetric models for query and document embeddings

Using separate embedding models for long documents and short user queries significantly improves overall document retrieval accuracy.

#8 about 2 min

Injecting dynamic access control lists into vector search indices

Embedding individual object access control rules straight into vector definitions allows continuous permission-based filtering directly within high-speed indexing loops.

#9 about 2 min

Combining semantic search scores with traditional keyword metrics

Merging localized vector scores with standard absolute text matches guarantees relevant results for conversational retrieval interfaces.

#10 about 3 min

Executing local reasoning models with conversational memory and citations

Passing retrieved document contexts and chat history to localized language models generates reliable streaming answers containing direct system citations.

#11 about 7 min

Integrating unified locally deployed chat interfaces inside existing intranets

Mounting interactive prompt overlays inside internal platforms enables cross-repository system querying without forcing operational data migration.

#12 about 4 min

Scaling local machine learning infrastructure via containerized environments

Orchestrating underlying dependency structures within standard containerized services offers reproducible full-stack inference deployments adaptable to variable hardware availability.

#13 about 6 min

Adopting non-disruptive knowledge discovery platforms using existing enterprise systems

Deploying isolated application gateways extends intelligent capabilities strictly atop legacy resources protecting structural compliance and fundamental file integrations.

Matching moments

2:32 min

Reviewing system architecture for custom semantic search

Iulia Feroli Iulia Feroli · LIVE

1:01 min

Customizing enterprise intelligence via automated RAG and secure APIs

Hissan Usmani Hissan Usmani · WWC 2025

3:49 min

Analyzing existing enterprise data systems for semantic AI integration

Christian Weyer Christian Weyer · WWC 2025

5:46 min

Scaling enterprise value via a unified AI platform

Julian Joseph · LIVE

2:53 min

Enhancing data validation and self-service analytics with AI

Kateřina Ščavnická Kateřina Ščavnická · WWC 2025

2:52 min

Scaling generative AI use cases across large enterprises

Mike Butcher Mike Butcher +3 · WWC 2024

Upcoming sessions on this topic

Open session

World Congress 2026 North America

AI Agents are Only as Smart as their Context: Building a Real-Time Context Engine at Intuit

Bharat Patel

Lead Software Engineer at Intuit

Bharat Patel
Open session

World Congress 2026 North America

No Single Model to Rule Them All: Building Resilient AI Agents Across Open & Closed LLMs

Emmanuel Acheampong

Senior Manager Developer Relations at Crusoe AI

Emmanuel Acheampong
Open session

World Congress 2026 North America

Making Science Larger, not just Faster

Yuval Dvir

Commercial Executive, SandboxAQ

Yuval Dvir
Open session

World Congress 2026 North America

Building Stuff with GenAI - The Open Minded Workshop beyond OpenAI

Andreas Erben

CTO for Applied AI and Metaverse at daenet

Andreas Erben
Open session

World Congress 2026 North America

Building Pragmatic AI: 10 AI Features Your Users Actually Want

Jonathan "J." Tower

.NET Foundation Board | 12x Microsoft MVP | Founder & Consultant

Jonathan "J." Tower
Open session

World Congress 2026 North America

DeepAgents: Build Multi-Agent AI Systems That Actually Work

Anjana Umapathy, Apoorva Jaiswal, Anagha Rumade

Anjana Umapathy
Apoorva Jaiswal
Anagha Rumade