World Congress 2026 Europe - Virtual Stage • Jul 2, 2026 • Session details

Building an AI-Ready Content Lake: Scaling RAG and Document AI Beyond Demos

Angel Borroy

Are disconnected documents bottlenecking your enterprise AI? Discover how an open-source, on-premise content lake scales RAG into production while strictly enforcing native access controls.

Pause
Mute Enter Fullscreen
#1 about 3 min

Overcoming fragmented semantic searches in enterprise document storage

Centralizing search indexing overcomes the limitations of siloed corporate repositories and purely keyword-based traditional search algorithms.

#2 about 4 min

Designing an on-premise document search system with data sovereignty

A permission-aware architecture provides multi-tenant semantic search without exposing sensitive enterprise data to external cloud solutions.

#3 about 5 min

Architectural components for metadata extraction and knowledge discovery

Utilizing non-relational databases and block storage extracts essential metadata to support deep text embedding and internal knowledge discovery.

#4 about 5 min

Creating robust continuous ingestion connectors for localized document sources

Implementing structured connectivity interfaces enables scheduled batch background operations and live synchronization of diverse content formats.

#5 about 3 min

Managing asynchronous metadata syncing and document chunking workflows

Separating fundamental record copying from computationally expensive asynchronous document chunking workflows protects overall application operational stability.

#6 about 3 min

Navigating graphical memory limitations and container deployment configuration

Configuring dynamic physical swap allocations and strict local container controls mitigates sudden inference failures caused by graphical hardware limitations.

#7 about 2 min

Utilizing asymmetric models for query and document embeddings

Using separate embedding models for long documents and short user queries significantly improves overall document retrieval accuracy.

#8 about 2 min

Injecting dynamic access control lists into vector search indices

Embedding individual object access control rules straight into vector definitions allows continuous permission-based filtering directly within high-speed indexing loops.

#9 about 2 min

Combining semantic search scores with traditional keyword metrics

Merging localized vector scores with standard absolute text matches guarantees relevant results for conversational retrieval interfaces.

#10 about 3 min

Executing local reasoning models with conversational memory and citations

Passing retrieved document contexts and chat history to localized language models generates reliable streaming answers containing direct system citations.

#11 about 7 min

Integrating unified locally deployed chat interfaces inside existing intranets

Mounting interactive prompt overlays inside internal platforms enables cross-repository system querying without forcing operational data migration.

#12 about 4 min

Scaling local machine learning infrastructure via containerized environments

Orchestrating underlying dependency structures within standard containerized services offers reproducible full-stack inference deployments adaptable to variable hardware availability.

#13 about 6 min

Adopting non-disruptive knowledge discovery platforms using existing enterprise systems

Deploying isolated application gateways extends intelligent capabilities strictly atop legacy resources protecting structural compliance and fundamental file integrations.

Matching moments

2:32 min

Reviewing system architecture for custom semantic search

Iulia Feroli Iulia Feroli · LIVE

1:01 min

Customizing enterprise intelligence via automated RAG and secure APIs

Hissan Usmani Hissan Usmani · World Congress 2025

37 sec

Preparing enterprise data foundations for artificial intelligence agents

Piotr Menclewicz Piotr Menclewicz · Europe 2026 Virtual

3:49 min

Analyzing existing enterprise data systems for semantic AI integration

Christian Weyer Christian Weyer · World Congress 2025

5:46 min

Scaling enterprise value via a unified AI platform

Julian Joseph · LIVE

2:53 min

Enhancing data validation and self-service analytics with AI

Kateřina Ščavnická Kateřina Ščavnická · World Congress 2025