Tech Lead ai - N H/F

OVHCloud
Coincy, France
21 days ago

Role details

Contract type
Temporary contract
Employment type
Full-time (> 32 hours)
Experience level
Expert
Working hours
Regular working hours

Tech stack

Artificial Intelligence Cloud Computing Code Review Continuous Integration DevOps Distributed Systems Python (Programming Language) Prometheus Software Engineering Rust (Programming Language) Grafana Generative AI
+3 more
Backend Kubernetes TensorRT

Job description

Au sein de votre équipe #OneTeam

  • Être le rĂ©fĂ©rent technique de l’équipe AI Solutions. Vous dĂ©finissez et faites Ă©voluer nos produits IA afin de garantir des services performants, fiables et scalables, avec une attention particuliĂšre portĂ©e Ă  l’infrastructure GPU, Ă  l’optimisation des modĂšles et Ă  l’excellence opĂ©rationnelle.

Vos principales responsabilités

  • Porter les choix d’architecture en tant que rĂ©fĂ©rent technique de l’équipe
  • Concevoir et faire Ă©voluer l’infrastructure nĂ©cessaire au dĂ©ploiement et Ă  l’exploitation des modĂšles d’IA
  • Optimiser les performances des modĂšles (quantization, batching, KV cache, tensor/pipeline parallelism, speculative decoding, etc.) et l’utilisation des ressources GPU (throughput, latency, memory footprint, cost efficiency)
  • Garantir la fiabilitĂ©, la scalabilitĂ© et l’observabilitĂ© des services en production
  • Contribuer Ă  la roadmap technique et accompagner sa mise en oeuvre
  • Promouvoir les bonnes pratiques d’ingĂ©nierie (revues de code, qualitĂ©, automatisation, CI/CD)
  • Assurer une veille technologique active sur l’écosystĂšme IA et partager les connaissances au sein de l’équipe
  • Accompagner les membres de l’équipe dans leur montĂ©e en compĂ©tences
  • Remettre en question les solutions existantes afin d’évoluer dans un contexte technologique en constante transformation

Votre futur impact

Dans 6 mois

  • Vous aurez pris vos marques en tant que rĂ©fĂ©rent technique au sein de l’équipe AI Solutions et aurez commencĂ© Ă  porter les choix d’architecture clĂ©s.
  • Vous aurez apprĂ©hendĂ© notre infrastructure GPU et contribuĂ© activement Ă  la feuille de route technique.
  • Vous aurez collaborĂ© Ă  l’optimisation des premiers modĂšles en production, en amĂ©liorant la latence et l’efficacitĂ© des ressources.
  • Vous aurez Ă©tabli une relation de confiance avec l’équipe pour l’accompagner dans sa montĂ©e en compĂ©tences au quotidien.
  • Vous aurez mis en application votre approche pragmatique en poussant de premiĂšres itĂ©rations rapides selon la culture “fail fast, learn fast” pour maximiser l’impact de nos produits d’intelligence artificielle.

Et dans 1 an

  • Vous aurez consolidĂ© l’infrastructure nĂ©cessaire au dĂ©ploiement des modĂšles IA Ă  grande Ă©chelle, garantissant une observabilitĂ© et une fiabilitĂ© irrĂ©prochables de nos services en production.
  • Vous aurez pleinement diffusĂ© les bonnes pratiques d’ingĂ©nierie et automatisĂ© les workflows via une dĂ©marche DevOps et Kubernetes. L’équipe aura gagnĂ© en maturitĂ© et en vĂ©locitĂ© sous votre impulsion technique.
  • Vous aurez pĂ©rennisĂ© notre stack en intĂ©grant les outils les plus performants du marchĂ© (vLLM, SGLang, TensorRT) grĂące Ă  votre veille active, maintenant OVHcloud Ă  la pointe de l’écosystĂšme de l’IA., Vous adoptez une approche AI Native au quotidien en exploitant les assistants de code et les outils d’IA gĂ©nĂ©rative pour dĂ©cupler votre productivitĂ© et la qualitĂ© de vos livrables.

Requirements

Vous disposez d’une solide expĂ©rience en dĂ©veloppement logiciel (Python, Rust, backend), en systĂšmes distribuĂ©s ainsi que dans le dĂ©ploiement de modĂšles d’IA en production.

  • Vous maĂźtrisez parfaitement les environnements GPU, le capacity planning associĂ©, ainsi que les infrastructures Cloud (Kubernetes, DevOps) et les outils d’observabilitĂ© (Prometheus, Grafana, OpenTelemetry).
  • Vous possĂ©dez une bonne familiaritĂ© avec des frameworks de pointe tels que vLLM, SGLang, TensorRT ou des Ă©quivalents technologiques du marchĂ©.
  • Vous ĂȘtes dotĂ© d’un leadership naturel, capable de fĂ©dĂ©rer autour de dĂ©cisions techniques complexes tout en affichant d’excellentes capacitĂ©s de communication et de collaboration.
  • Vous faites preuve d’adaptabilitĂ© et d’une grande curiositĂ© face Ă  l’évolution rapide des technologies, avec une approche rĂ©solument orientĂ©e impact, rĂ©sultats et itĂ©ration rapide.

C’est un +

  • Vous adoptez une approche AI Native au quotidien en exploitant les assistants de code et les outils d’IA gĂ©nĂ©rative pour dĂ©cupler votre productivitĂ© et la qualitĂ© de vos livrables., Vous disposez d’une solide expĂ©rience en dĂ©veloppement logiciel (Python, Rust, backend), en systĂšmes distribuĂ©s ainsi que dans le dĂ©ploiement de modĂšles d’IA en production.
  • Vous maĂźtrisez parfaitement les environnements GPU, le capacity planning associĂ©, ainsi que les infrastructures Cloud (Kubernetes, DevOps) et les outils d’observabilitĂ© (Prometheus, Grafana, OpenTelemetry).
  • Vous possĂ©dez une bonne familiaritĂ© avec des frameworks de pointe tels que vLLM, SGLang, TensorRT ou des Ă©quivalents technologiques du marchĂ©.
  • Vous ĂȘtes dotĂ© d’un leadership naturel, capable de fĂ©dĂ©rer autour de dĂ©cisions techniques complexes tout en affichant d’excellentes capacitĂ©s de communication et de collaboration.
  • Vous faites preuve d’adaptabilitĂ© et d’une grande curiositĂ© face Ă  l’évolution rapide des technologies, avec une approche rĂ©solument orientĂ©e impact, rĂ©sultats et itĂ©ration rapide., Management d’équipe Prometheus Intelligence artificielle Grafana DĂ©veloppement logiciel Veille technologique Batching Kubernetes Python QualitĂ© fĂ©dĂ©ratrice

Apply for this position

This job is hosted externally. Click below to view the full posting and apply.

Apply on www.hellowork.com

Good distractions

Talks and stories from around this role — technically off-topic, practically not.

2:17 min

Mapping the maturity roadmap for scaled devops adoption

Dominik Krichbaum Dominik Krichbaum · WWC Europe 2026

10:40 min

Visualizing Prometheus open metrics using custom Grafana dashboards

Stijn Polfliet · LIVE

1:52 min

Structuring and scaling the backend engineering team

Stefan Lingler Stefan Lingler +1 · Coffee With Developers

2:37 min

Optimizing technical profiles for AI sourcing and recruitment

Mina Golesorkhi Mina Golesorkhi · WWC Europe 2026

3:18 min

Scaling global network engineering through DevOps culture

Stuart Clark · LIVE

4:36 min

Hiring passionate software engineers to tackle unprecedented scaling challenges

Dana Lawson Dana Lawson +1 · WWC Europe 2026

Videos

See all

Related articles

See all