Tech Lead Backend Python - ai Services - Llm H/F

B485b5ccacbf18b528fc8690da40d035
Courbevoie, France
2 days ago
Apply on www.hellowork.com
Prepare application

Role details

Contract type
Permanent contract
Employment type
Full-time (> 32 hours)
Experience level
Expert
Working hours
Regular working hours
Languages
English

Tech stack

Java (Programming Language) Application Programming Interfaces (APIs) Artificial Intelligence Amazon Web Services Microsoft Azure Software Quality Code Review Continuous Integration Python (Programming Language) PostgreSQL Redis Data Streaming
+13 more
Management of Software Versions WebSocket Planning Software Large Language Models Generative AI Backend Fastapi Pytest Kubernetes Apache Kafka Celery AWS EKS Docker

Job description

Dans le cadre de la construction d’une plateforme IA européenne destinée aux professionnels du droit, l’équipe AI Services recherche un profil senior capable de développer et d’industrialiser les services permettant aux différents produits du groupe d’exploiter des modèles de langage.

La mission porte principalement sur la couche Backend LLM : exposition des capacités IA, orchestration, streaming des réponses et mise en production de services performants et fiables.

Missions principales

  • Concevoir et développer des APIs Python permettant d’exposer les capacités IA aux différents produits.
  • Intégrer et orchestrer plusieurs fournisseurs et modèles LLM.
  • Mettre en place le streaming des réponses et les traitements asynchrones.
  • Développer des mécanismes de function calling, tools et agents IA.
  • Participer à l’intégration des pipelines RAG et des services de Retrieval.
  • Optimiser les performances, la latence et les coûts d’utilisation des modèles.
  • Mettre en oeuvre les mécanismes de résilience : timeouts, retries, fallbacks et circuit breakers.
  • Garantir la sécurité, la traçabilité et l’isolation des données.
  • Définir les contrats d’API, leur versioning et leur documentation.
  • Mettre en place l’observabilité : logs, métriques, traces, consommation de tokens et suivi des coûts.
  • Réaliser les revues de code et accompagner les développeurs sur les bonnes pratiques Python et IA.
  • Contribuer aux choix d’architecture et à l’industrialisation du socle AI Services.

Environnement technique

  • Backend : Python 3.11+, FastAPI, Starlette, Pydantic, Uvicorn
  • Asynchrone : asyncio, httpx, Celery
  • Streaming : SSE, WebSockets
  • IA : OpenAI, Azure OpenAI, Mistral, AWS Bedrock
  • Orchestration : LangChain, LangGraph, function calling, agents et tools
  • Data & Retrieval : OpenSearch, Weaviate, PostgreSQL, pgvector, Redis
  • Messaging : Kafka
  • Cloud : AWS et/ou Azure
  • Industrialisation : Docker, Kubernetes, CI/CD
  • Tests : Pytest, pytest-asyncio

Requirements

Profil recherchéProfil recherchéExpérience confirmée en développement Backend Python sur des services en production.Maîtrise de FastAPI et de la programmation asynchrone avec asyncio.Expérience concrète dans l’intégration de LLM en production.Maîtrise du streaming, de la concurrence et des traitements distribués.Bonne compréhension des architectures RAG, des tools et des agents IA.Capacité à gérer les contraintes de latence, de coût, de fiabilité et de sécurité.Expérience dans la conception et l’exploitation d’APIs critiques.Bonne culture engineering : tests, versioning, qualité du code et observabilité.Capacité à rester très opérationnel dans le développement.Anglais professionnel dans un contexte international.Qualités attenduesAutonomie et forte capacité d’exécution.Leadership technique et pédagogie.Rigueur sur la qualité, la sécurité et la fiabilité.Sensibilité produit et compréhension des besoins des équipes consommatrices.Capacité à vulgariser des sujets techniques complexes.Esprit d’innovation et veille active sur l’écosystème GenAI.Points indispensablesLe profil doit pouvoir démontrer une expérience réelle sur :des APIs Python/FastAPI en production ;l’asynchronisme et le streaming de réponses LLM ;l’intégration de modèles de langage dans des services critiques ;la performance, la résilience et l’observabilité ;une contribution directe et régulière au code.Une expérience en Go ou Java constitue un plus., * Expérience confirmée en développement Backend Python sur des services en production.

  • Maîtrise de FastAPI et de la programmation asynchrone avec asyncio.
  • Expérience concrète dans l’intégration de LLM en production.
  • Maîtrise du streaming, de la concurrence et des traitements distribués.
  • Bonne compréhension des architectures RAG, des tools et des agents IA.
  • Capacité à gérer les contraintes de latence, de coût, de fiabilité et de sécurité.
  • Expérience dans la conception et l’exploitation d’APIs critiques.
  • Bonne culture engineering : tests, versioning, qualité du code et observabilité.
  • Capacité à rester très opérationnel dans le développement.
  • Anglais professionnel dans un contexte international.

Qualités attendues

  • Autonomie et forte capacité d’exécution.
  • Leadership technique et pédagogie.
  • Rigueur sur la qualité, la sécurité et la fiabilité.
  • Sensibilité produit et compréhension des besoins des équipes consommatrices.
  • Capacité à vulgariser des sujets techniques complexes.
  • Esprit d’innovation et veille active sur l’écosystème GenAI.

Points indispensables

Le profil doit pouvoir démontrer une expérience réelle sur :

  • des APIs Python/FastAPI en production ;
  • l’asynchronisme et le streaming de réponses LLM ;
  • l’intégration de modèles de langage dans des services critiques ;
  • la performance, la résilience et l’observabilité ;
  • une contribution directe et régulière au code.

Une expérience en Go ou Java constitue un plus.

EUR

Management d’équipe Anglais Intelligence artificielle API AWS Kubernetes Python Autonomie KAFKA PostgreSQL Programmation Logiciels de gestion de versions Docker Isolation

Benefits & conditions

Taux journalier :Salaire selon profil

False

EducationalOccupationalCredential postgraduate degree EducationalOccupationalCredential bachelor degree EducationalOccupationalCredential

Apply for this position

This job is hosted externally. Click below to view the full posting and apply.

Apply on www.hellowork.com
Prepare application

Good distractions

Talks and stories from around this role — technically off-topic, practically not.

3:55 min

Demonstrating semantic routing thresholds with the Redis vector library

3:05 min

Tagging and organizing execution scenarios with pytest markers

Florian Bruhin · World Congress 2021

1:37 min

Core concepts of Celery and message broker integration

Jan Giacomelli · LIVE

2:37 min

Optimizing technical profiles for AI sourcing and recruitment

Mina Golesorkhi Mina Golesorkhi · World Congress 2026 Europe

3:42 min

Comparing in-memory and Redis storage for cache scalability

Simone Sanfratello · World Congress 2022

1:06 min

Choosing the right language for AI workloads

Marc Arndt Marc Arndt · World Congress 2026 Europe

Videos

See all

Related articles

See all