Tech Lead Backend Python - ai Services - Llm H/F
- Discuss this with your agent
- Open in Claude
- Open in ChatGPT
Prepare application
- Draft this with your agent
- Open in Claude
- Open in ChatGPT
Role details
Tech stack
+13 more
Job description
Dans le cadre de la construction d’une plateforme IA européenne destinée aux professionnels du droit, l’équipe AI Services recherche un profil senior capable de développer et d’industrialiser les services permettant aux différents produits du groupe d’exploiter des modèles de langage.
La mission porte principalement sur la couche Backend LLM : exposition des capacités IA, orchestration, streaming des réponses et mise en production de services performants et fiables.
Missions principales
- Concevoir et développer des APIs Python permettant d’exposer les capacités IA aux différents produits.
- Intégrer et orchestrer plusieurs fournisseurs et modèles LLM.
- Mettre en place le streaming des réponses et les traitements asynchrones.
- Développer des mécanismes de function calling, tools et agents IA.
- Participer à l’intégration des pipelines RAG et des services de Retrieval.
- Optimiser les performances, la latence et les coûts d’utilisation des modèles.
- Mettre en oeuvre les mécanismes de résilience : timeouts, retries, fallbacks et circuit breakers.
- Garantir la sécurité, la traçabilité et l’isolation des données.
- Définir les contrats d’API, leur versioning et leur documentation.
- Mettre en place l’observabilité : logs, métriques, traces, consommation de tokens et suivi des coûts.
- Réaliser les revues de code et accompagner les développeurs sur les bonnes pratiques Python et IA.
- Contribuer aux choix d’architecture et à l’industrialisation du socle AI Services.
Environnement technique
- Backend : Python 3.11+, FastAPI, Starlette, Pydantic, Uvicorn
- Asynchrone : asyncio, httpx, Celery
- Streaming : SSE, WebSockets
- IA : OpenAI, Azure OpenAI, Mistral, AWS Bedrock
- Orchestration : LangChain, LangGraph, function calling, agents et tools
- Data & Retrieval : OpenSearch, Weaviate, PostgreSQL, pgvector, Redis
- Messaging : Kafka
- Cloud : AWS et/ou Azure
- Industrialisation : Docker, Kubernetes, CI/CD
- Tests : Pytest, pytest-asyncio
Requirements
Profil recherchéProfil recherchéExpérience confirmée en développement Backend Python sur des services en production.Maîtrise de FastAPI et de la programmation asynchrone avec asyncio.Expérience concrète dans l’intégration de LLM en production.Maîtrise du streaming, de la concurrence et des traitements distribués.Bonne compréhension des architectures RAG, des tools et des agents IA.Capacité à gérer les contraintes de latence, de coût, de fiabilité et de sécurité.Expérience dans la conception et l’exploitation d’APIs critiques.Bonne culture engineering : tests, versioning, qualité du code et observabilité.Capacité à rester très opérationnel dans le développement.Anglais professionnel dans un contexte international.Qualités attenduesAutonomie et forte capacité d’exécution.Leadership technique et pédagogie.Rigueur sur la qualité, la sécurité et la fiabilité.Sensibilité produit et compréhension des besoins des équipes consommatrices.Capacité à vulgariser des sujets techniques complexes.Esprit d’innovation et veille active sur l’écosystème GenAI.Points indispensablesLe profil doit pouvoir démontrer une expérience réelle sur :des APIs Python/FastAPI en production ;l’asynchronisme et le streaming de réponses LLM ;l’intégration de modèles de langage dans des services critiques ;la performance, la résilience et l’observabilité ;une contribution directe et régulière au code.Une expérience en Go ou Java constitue un plus., * Expérience confirmée en développement Backend Python sur des services en production.
- Maîtrise de FastAPI et de la programmation asynchrone avec asyncio.
- Expérience concrète dans l’intégration de LLM en production.
- Maîtrise du streaming, de la concurrence et des traitements distribués.
- Bonne compréhension des architectures RAG, des tools et des agents IA.
- Capacité à gérer les contraintes de latence, de coût, de fiabilité et de sécurité.
- Expérience dans la conception et l’exploitation d’APIs critiques.
- Bonne culture engineering : tests, versioning, qualité du code et observabilité.
- Capacité à rester très opérationnel dans le développement.
- Anglais professionnel dans un contexte international.
Qualités attendues
- Autonomie et forte capacité d’exécution.
- Leadership technique et pédagogie.
- Rigueur sur la qualité, la sécurité et la fiabilité.
- Sensibilité produit et compréhension des besoins des équipes consommatrices.
- Capacité à vulgariser des sujets techniques complexes.
- Esprit d’innovation et veille active sur l’écosystème GenAI.
Points indispensables
Le profil doit pouvoir démontrer une expérience réelle sur :
- des APIs Python/FastAPI en production ;
- l’asynchronisme et le streaming de réponses LLM ;
- l’intégration de modèles de langage dans des services critiques ;
- la performance, la résilience et l’observabilité ;
- une contribution directe et régulière au code.
Une expérience en Go ou Java constitue un plus.
EUR
Management d’équipe Anglais Intelligence artificielle API AWS Kubernetes Python Autonomie KAFKA PostgreSQL Programmation Logiciels de gestion de versions Docker Isolation
Benefits & conditions
Taux journalier :Salaire selon profil
False
EducationalOccupationalCredential postgraduate degree EducationalOccupationalCredential bachelor degree EducationalOccupationalCredential
Apply for this position
This job is hosted externally. Click below to view the full posting and apply.
Prepare application
- Draft this with your agent
- Open in Claude
- Open in ChatGPT
Good distractions
Talks and stories from around this role — technically off-topic, practically not.
Moments
Explore playlistsVideos
See allRelated articles
See all
What Are Large Language Models?
Best Companies to Work For in France: Top 25 Companies in 2023Â
From Prototype to Production: Build AI Agents with This Free 4-Course Learning Path
Dev Digest 121 - AI goes offline