> Markdown version of [/jobs/ext/2287809-tech-lead-expert-data-retrieval-rag-legaltech-pre-embauche-client-final-h-f](https://www.wearedevelopers.com/jobs/ext/2287809-tech-lead-expert-data-retrieval-rag-legaltech-pre-embauche-client-final-h-f). Every page supports `.md` or `Accept: text/markdown`. Links point to the HTML versions so they work for humans too. Agent guide: [/agents.md](https://www.wearedevelopers.com/agents.md). --- # Tech Lead Expert Data Retrieval & Rag Legaltech - Pré Embauche - Client Final H/F - **Company:** Tech Lead - **Location:** France - **Experience:** Expert - **Contract:** Temporary to permanent - **Skills:** Clean Code Principles, Artificial Intelligence, Airflow, Automation of Tests, Continuous Integration, Information Retrieval, Python (Programming Language), PostgreSQL, Open Source Technology, Redis, Management of Software Versions, WebKit, Large Language Models, Apache Spark, Pytest, Kubernetes, Docker - **Published:** August 29, 2026 - **Apply:** https://www.hellowork.com/fr-fr/emplois/82755034.html ## About the Role Profil recherchéMaster, PhD, ou équivalentMaîtrise de Python 3.11+ et connaissance de GoExpérience avec des bases vectorielles telles que pgvector, Weaviate, Qdrant, OpenSearch et recherche hybride / BM25Compétences en embeddings et NLP : sentence-transformers, modèles d'embeddings, tokenisation, parsing de documentsConnaissance des outils RAG et LLM : LangChain, RAG, reranking, OpenAI, Mistral, BedrockCompétences en data & infrastructure : PostgreSQL, Airflow / Spark (ou équivalent), Kefka, Redis, Docker, CI/CD, K8SMaîtrise des tests avec Pytest et évaluation de la pertinence (recall, nDCG, MRR)Expérience avérée en data engineering / information retrieval en productionExpertise en retrieval, pipelines reproductibles, culture IA/MLAnglais fluide (contexte européen quotidien)Qualités personnelles : vision produit, pédagogie, rigueur sécurité, curiosité innovation, communication claire Mais aussi... Taux journalier :800.css-11k7fwb{display:inline-block;white-space:nowrap;vertical-align:middle;-webkit-padding-start:var(--chakra-space-1-5);padding-inline-start:var(--chakra-space-1-5);-webkit-padding-end:var(--chakra-space-1-5);padding-inline-end:var(--chakra-space-1-5);text-transform:none;font-size:var(--chakra-fontSizes-xs);border-radius:var(--chakra-radii-md);font-weight:var(--chakra-fontWeights-semibold);background:var(--chakra-colors-success-200);color:var(--chakra-colors-success-700);box-shadow:var(--badge-shadow);padding:4px 6px;--badge-bg:var(--chakra-colors-success-100);--badge-color:colors.success.800;}.chakra-ui-dark .css-11k7fwb:not([data-theme]),[data-theme=dark] .css-11k7fwb:not([data-theme]),.css-11k7fwb[data-theme=dark]{--badge-bg:rgba(226, 243, 232, 0.16);--badge-color:var(--chakra-colors-success-200);}Cette offre est à 0% de commission .css-74lrwu{width:1em;height:1em;line-height:1em;-webkit-flex-shrink:0;-ms-flex-negative:0;flex-shrink:0;color:currentColor;font-size:16px;display:-webkit-box;display:-webkit-flex;display:-ms-flexbox;display:flex;-webkit-transition:.1s ease-in-out color;transition:.1s ease-in-out color;}.css-74lrwu *{-webkit-transition:.1s ease-in-out fill;transition:.1s ease-in-out fill;fill:var(--chakra-colors-rythm-600);}, 1. Master, PhD, ou équivalent 2. Maîtrise de Python 3.11+ et connaissance de Go 3. Expérience avec des bases vectorielles telles que pgvector, Weaviate, Qdrant, OpenSearch et recherche hybride / BM25 4. Compétences en embeddings et NLP : sentence-transformers, modèles d'embeddings, tokenisation, parsing de documents 5. Connaissance des outils RAG et LLM : LangChain, RAG, reranking, OpenAI, Mistral, Bedrock 6. Compétences en data & infrastructure : PostgreSQL, Airflow / Spark (ou équivalent), Kefka, Redis, Docker, CI/CD, K8S 7. Maîtrise des tests avec Pytest et évaluation de la pertinence (recall, nDCG, MRR) 8. Expérience avérée en data engineering / information retrieval en production 9. Expertise en retrieval, pipelines reproductibles, culture IA/ML 10. Anglais fluide (contexte européen quotidien) 11. Qualités personnelles : vision produit, pédagogie, rigueur sécurité, curiosité innovation, communication claire EUR Anglais Intelligence artificielle Clean Normalisation Python PostgreSQL Docker ## Description Tech lead Expert Data Retrieval RAG. PRE EMBAUCHE - 6 mois de mission maximum. Au sein de l'équipe AI Service, vous contribuerez à la conception de pipelines d'ingestion, d'indexation et de recherche pour des corpus juridiques massifs. Enjeu : garantir la fraîcheur et la qualité du retrieval (sémantique et hybride) pour des équipes réparties en Europe, en respectant la sécurité et la conformité des données (RGPD, cloisonnement par pays)., Collecte, ingestion & indexation : concevoir des pipelines pour sources hétérogènes (parsing, nettoyage, chunking, normalisation), industrialiser modèles d'embeddings, alimenter et maintenir bases vectorielles, gérer fraîcheur et reconstruction des index, garantir scalabilité et traçabilité (lignage, versioning). - Recherche & pertinence (Retrieval) : piloter stratégie combinant recherche lexicale et sémantique (BM25 + embeddings), reranking et filtrage par métadonnées ; structurer la phase de récupération pour alimenter les LLM (contexte, citations, dé-duplication, gestion des fenêtres de contexte) ; mettre en place jeux de tests et métriques (recall, precision, nDCG, MRR) ; instrumenter pipelines (logs, métriques, traces de qualité) et garantir observability et security. - Leadership technique & gouvernance : promouvoir Clean Code, SOLID, tests automatisés ; assurer veille, documentation et rayonnement technique (articles, meetups, open-source). Livrables : pipelines reproductibles, index robustes et métriques de pertinence opérationnelles. Outils & Environnement - Langages : Python 3.11+ (maîtrise requise), Go - Indexation : bases vectorielles (pgvector, Weaviate, Qdrant, OpenSearch), recherche hybride / BM25 - Embeddings & NLP : sentence-transformers, modèles d'embeddings, tokenisation, parsing de documents - RAG & LLM : LangChain, RAG, reranking, OpenAI, Mistral, Bedrock - Data & infra : PostgreSQL, Airflow / Spark (ou équivalent), Kefka, Redis, Docker, CI/CD, K8S - Tests : Pytest ; évaluation de la pertinence (recall, nDCG, MRR) Conditions de travail - Pré embauche - Mission de 6 mois maximum - Contexte européen avec équipes réparties en Europe - Respect des normes RGPD et cloisonnement par pays ## Related Videos - [Recruitment Reinvented: Bold strategies and the $10K signing incentive](https://www.wearedevelopers.com/videos/1068-recruitment-reinvented-bold-strategies-and-the-10k-signing-incentive) - [pytest: Simple, rapid and fun testing with Python](https://www.wearedevelopers.com/videos/213-pytest-simple-rapid-and-fun-testing-with-python) - [Docker Compose: Rediscovered](https://www.wearedevelopers.com/videos/1978-docker-compose-rediscovered) - [Reducing LLM Calls with Vector Search Patterns - Raphael De Lio (Redis)](https://www.wearedevelopers.com/videos/1714-reducing-llm-calls-with-vector-search-patterns-raphael-de-lio-redis) - [Automagic Configuration in Python](https://www.wearedevelopers.com/videos/363-automagic-configuration-in-python) - [Docker build without Docker](https://www.wearedevelopers.com/videos/100114-docker-build-without-docker) ## Related Articles - [Best Companies to Work For in Paris: Top 25 Companies in 2023 ](https://www.wearedevelopers.com/magazine/190-best-companies-to-work-for-in-paris-top-25-companies-in-2023) - [Dev Digest 121 - AI goes offline](https://www.wearedevelopers.com/magazine/456-dev-digest-121-ai-goes-offline) - [Best Companies to Work For in France: Top 25 Companies in 2023 ](https://www.wearedevelopers.com/magazine/189-best-companies-to-work-for-in-france-top-25-companies-in-2023) - [Dev Digest 120 - Apple and peers](https://www.wearedevelopers.com/magazine/455-dev-digest-120-apple-and-peers) - [Data Engineer Salary UK](https://www.wearedevelopers.com/magazine/253-data-engineer-salary-uk) - [Best Coding Boot Camps in Germany](https://www.wearedevelopers.com/magazine/237-best-coding-boot-camps-in-germany)