Tech Lead ai - N H/F

OVHCloud
Canton of Château-Thierry, France
3 days ago

Role details

Contract type
Temporary contract
Employment type
Full-time (> 32 hours)
Working hours
Regular working hours
Languages
French
Experience level
Senior

Job location

Canton of Château-Thierry, France

Tech stack

Artificial Intelligence
Cloud Computing
Code Review
Continuous Integration
DevOps
Distributed Systems
Python
Prometheus
Software Engineering
Rust
Grafana
Generative AI
Backend
Kubernetes
TensorRT

Job description

Au sein de votre équipe #OneTeam

  • Être le référent technique de l'équipe AI Solutions. Vous définissez et faites évoluer nos produits IA afin de garantir des services performants, fiables et scalables, avec une attention particulière portée à l'infrastructure GPU, à l'optimisation des modèles et à l'excellence opérationnelle.

Vos principales responsabilités

  • Porter les choix d'architecture en tant que référent technique de l'équipe
  • Concevoir et faire évoluer l'infrastructure nécessaire au déploiement et à l'exploitation des modèles d'IA
  • Optimiser les performances des modèles (quantization, batching, KV cache, tensor/pipeline parallelism, speculative decoding, etc.) et l'utilisation des ressources GPU (throughput, latency, memory footprint, cost efficiency)
  • Garantir la fiabilité, la scalabilité et l'observabilité des services en production
  • Contribuer à la roadmap technique et accompagner sa mise en oeuvre
  • Promouvoir les bonnes pratiques d'ingénierie (revues de code, qualité, automatisation, CI/CD)
  • Assurer une veille technologique active sur l'écosystème IA et partager les connaissances au sein de l'équipe
  • Accompagner les membres de l'équipe dans leur montée en compétences
  • Remettre en question les solutions existantes afin d'évoluer dans un contexte technologique en constante transformation

Votre futur impact

Dans 6 mois

  • Vous aurez pris vos marques en tant que référent technique au sein de l'équipe AI Solutions et aurez commencé à porter les choix d'architecture clés.
  • Vous aurez appréhendé notre infrastructure GPU et contribué activement à la feuille de route technique.
  • Vous aurez collaboré à l'optimisation des premiers modèles en production, en améliorant la latence et l'efficacité des ressources.
  • Vous aurez établi une relation de confiance avec l'équipe pour l'accompagner dans sa montée en compétences au quotidien.
  • Vous aurez mis en application votre approche pragmatique en poussant de premières itérations rapides selon la culture "fail fast, learn fast" pour maximiser l'impact de nos produits d'intelligence artificielle.

Et dans 1 an

  • Vous aurez consolidé l'infrastructure nécessaire au déploiement des modèles IA à grande échelle, garantissant une observabilité et une fiabilité irréprochables de nos services en production.
  • Vous aurez pleinement diffusé les bonnes pratiques d'ingénierie et automatisé les workflows via une démarche DevOps et Kubernetes. L'équipe aura gagné en maturité et en vélocité sous votre impulsion technique.
  • Vous aurez pérennisé notre stack en intégrant les outils les plus performants du marché (vLLM, SGLang, TensorRT) grâce à votre veille active, maintenant OVHcloud à la pointe de l'écosystème de l'IA., Vous adoptez une approche AI Native au quotidien en exploitant les assistants de code et les outils d'IA générative pour décupler votre productivité et la qualité de vos livrables.

Requirements

Vous disposez d'une solide expérience en développement logiciel (Python, Rust, backend), en systèmes distribués ainsi que dans le déploiement de modèles d'IA en production.

  • Vous maîtrisez parfaitement les environnements GPU, le capacity planning associé, ainsi que les infrastructures Cloud (Kubernetes, DevOps) et les outils d'observabilité (Prometheus, Grafana, OpenTelemetry).
  • Vous possédez une bonne familiarité avec des frameworks de pointe tels que vLLM, SGLang, TensorRT ou des équivalents technologiques du marché.
  • Vous êtes doté d'un leadership naturel, capable de fédérer autour de décisions techniques complexes tout en affichant d'excellentes capacités de communication et de collaboration.
  • Vous faites preuve d'adaptabilité et d'une grande curiosité face à l'évolution rapide des technologies, avec une approche résolument orientée impact, résultats et itération rapide.

C'est un +

  • Vous adoptez une approche AI Native au quotidien en exploitant les assistants de code et les outils d'IA générative pour décupler votre productivité et la qualité de vos livrables., Vous disposez d'une solide expérience en développement logiciel (Python, Rust, backend), en systèmes distribués ainsi que dans le déploiement de modèles d'IA en production.
  • Vous maîtrisez parfaitement les environnements GPU, le capacity planning associé, ainsi que les infrastructures Cloud (Kubernetes, DevOps) et les outils d'observabilité (Prometheus, Grafana, OpenTelemetry).
  • Vous possédez une bonne familiarité avec des frameworks de pointe tels que vLLM, SGLang, TensorRT ou des équivalents technologiques du marché.
  • Vous êtes doté d'un leadership naturel, capable de fédérer autour de décisions techniques complexes tout en affichant d'excellentes capacités de communication et de collaboration.
  • Vous faites preuve d'adaptabilité et d'une grande curiosité face à l'évolution rapide des technologies, avec une approche résolument orientée impact, résultats et itération rapide., Management d'équipe Prometheus Intelligence artificielle Grafana Développement logiciel Veille technologique Batching Kubernetes Python Qualité fédératrice

Apply for this position