Tech Lead AI H/F

OVHCloud
Cesson-Sévigné, France
20 days ago

Role details

Contract type
Permanent contract
Employment type
Full-time (> 32 hours)
Experience level
Expert
Working hours
Regular working hours
Job source

Tech stack

Artificial Intelligence Cloud Computing Code Review Continuous Integration DevOps Distributed Systems Python (Programming Language) Prometheus Software Engineering Rust (Programming Language) Grafana Generative AI
+3 more
Backend Kubernetes TensorRT

Job description

Au sein de votre équipe #OneTeam

  • Être le référent technique de l’équipe AI Solutions. Vous définissez et faites évoluer nos produits IA afin de garantir des services performants, fiables et scalables, avec une attention particulière portée à l’infrastructure GPU, à l’optimisation des modèles et à l’excellence opérationnelle.

Vos principales responsabilités

  • Porter les choix d’architecture en tant que référent technique de l’équipe
  • Concevoir et faire évoluer l’infrastructure nécessaire au déploiement et à l’exploitation des modèles d’IA
  • Optimiser les performances des modèles (quantization, batching, KV cache, tensor/pipeline parallelism, speculative decoding, etc.) et l’utilisation des ressources GPU (throughput, latency, memory footprint, cost efficiency)
  • Garantir la fiabilité, la scalabilité et l’observabilité des services en production
  • Contribuer à la roadmap technique et accompagner sa mise en œuvre
  • Promouvoir les bonnes pratiques d’ingénierie (revues de code, qualité, automatisation, CI/CD)
  • Assurer une veille technologique active sur l’écosystème IA et partager les connaissances au sein de l’équipe
  • Accompagner les membres de l’équipe dans leur montée en compétences
  • Remettre en question les solutions existantes afin d’évoluer dans un contexte technologique en constante transformation

Votre futur impact

Dans 6 mois

  • Vous aurez pris vos marques en tant que référent technique au sein de l’équipe AI Solutions et aurez commencé à porter les choix d’architecture clés.
  • Vous aurez appréhendé notre infrastructure GPU et contribué activement à la feuille de route technique.
  • Vous aurez collaboré à l’optimisation des premiers modèles en production, en améliorant la latence et l’efficacité des ressources.
  • Vous aurez établi une relation de confiance avec l’équipe pour l’accompagner dans sa montée en compétences au quotidien.
  • Vous aurez mis en application votre approche pragmatique en poussant de premières itérations rapides selon la culture “fail fast, learn fast” pour maximiser l’impact de nos produits d’intelligence artificielle.

Et dans 1 an

  • Vous aurez consolidé l’infrastructure nécessaire au déploiement des modèles IA à grande échelle, garantissant une observabilité et une fiabilité irréprochables de nos services en production.
  • Vous aurez pleinement diffusé les bonnes pratiques d’ingénierie et automatisé les workflows via une démarche DevOps et Kubernetes. L’équipe aura gagné en maturité et en vélocité sous votre impulsion technique.
  • Vous aurez pérennisé notre stack en intégrant les outils les plus performants du marché (vLLM, SGLang, TensorRT) grâce à votre veille active, maintenant OVHcloud à la pointe de l’écosystème de l’IA.

Requirements

  • Vous disposez d’une solide expérience en développement logiciel (Python, Rust, backend), en systèmes distribués ainsi que dans le déploiement de modèles d’IA en production.
  • Vous maîtrisez parfaitement les environnements GPU, le capacity planning associé, ainsi que les infrastructures Cloud (Kubernetes, DevOps) et les outils d’observabilité (Prometheus, Grafana, OpenTelemetry).
  • Vous possédez une bonne familiarité avec des frameworks de pointe tels que vLLM, SGLang, TensorRT ou des équivalents technologiques du marché.
  • Vous êtes doté d’un leadership naturel, capable de fédérer autour de décisions techniques complexes tout en affichant d’excellentes capacités de communication et de collaboration.
  • Vous faites preuve d’adaptabilité et d’une grande curiosité face à l’évolution rapide des technologies, avec une approche résolument orientée impact, résultats et itération rapide.

C’est un +

  • Vous adoptez une approche AI Native au quotidien en exploitant les assistants de code et les outils d’IA générative pour décupler votre productivité et la qualité de vos livrables.

About the company

︎ Une politique de télétravail hybride ︎ Un plan d’actionnariat salarié ︎ Un programme de reconnaissance de l’ancienneté ︎ Des subventions vacances et sport ︎ Berceau et crèche d’entreprise (selon site)

Mais aussi : ︎ Des équipes multiculturelles ︎ Des locaux bien équipés ︎ Une plateforme de formation et de certification en ligne ︎ Une offre d’accompagnement médical et social digitalisée pour vous et votre famille

REJOINDRE L’AVENTURE OVHCLOUD

OVHcloud valorise la diversité des personnes qu’elle embauche et accompagne. La diversité pour nous, c’est favoriser un milieu de travail où les différences individuelles sont reconnues, appréciées et respectées de façon à développer le plein potentiel et les forces de chacune et chacun. Soyez libre d’être vous-même !

L’IA DANS L’ADN

L’intelligence artificielle réinvente nos métiers au quotidien. Rejoignez-nous pour explorer ses immenses possibilités et coconstruire l’avenir !

LE DÉVELOPPEMENT DURABLE CHEZ OVHCLOUD, UN ENGAGEMENT PROFOND

Vous voulez contribuer à des projets uniques pour construire ensemble le cloud libre ? Allons-y ! Chez OVHcloud, nous sommes animés par la même volonté, celle de construire l’avenir ensemble pour défendre la liberté d’innover. Découvrez l’acteur majeur du cloud libre et responsable

Apply for this position

This job is hosted externally. Click below to view the full posting and apply.

Apply on fr.indeed.com

Good distractions

Talks and stories from around this role — technically off-topic, practically not.

2:14 min

Exploring internal AI product initiatives and global engineering roles

Maria Apazoglou · Coffee With Developers

2:17 min

Mapping the maturity roadmap for scaled devops adoption

Dominik Krichbaum Dominik Krichbaum · WWC Europe 2026

10:40 min

Visualizing Prometheus open metrics using custom Grafana dashboards

Stijn Polfliet · LIVE

1:52 min

Structuring and scaling the backend engineering team

Stefan Lingler Stefan Lingler +1 · Coffee With Developers

4:36 min

Hiring passionate software engineers to tackle unprecedented scaling challenges

Dana Lawson Dana Lawson +1 · WWC Europe 2026

3:18 min

Scaling global network engineering through DevOps culture

Stuart Clark · LIVE

Videos

See all

Related articles

See all