> Markdown version of [/jobs/ext/1363735-tech-lead-ai-n-h-f](https://www.wearedevelopers.com/jobs/ext/1363735-tech-lead-ai-n-h-f). Every page supports `.md` or `Accept: text/markdown`. Links point to the HTML versions so they work for humans too. Agent guide: [/agents.md](https://www.wearedevelopers.com/agents.md). --- # Tech Lead ai - N H/F - **Company:** OVHCloud - **Location:** Coincy, France - **Experience:** Expert - **Contract:** Temporary contract - **Skills:** Artificial Intelligence, Cloud Computing, Code Review, Continuous Integration, DevOps, Distributed Systems, Python (Programming Language), Prometheus, Software Engineering, Rust (Programming Language), Grafana, Generative AI, Backend, Kubernetes, TensorRT - **Published:** July 21, 2026 - **Apply:** https://www.hellowork.com/fr-fr/emplois/81491162.html ## About the Role Vous disposez d'une solide expérience en développement logiciel (Python, Rust, backend), en systèmes distribués ainsi que dans le déploiement de modèles d'IA en production. - Vous maîtrisez parfaitement les environnements GPU, le capacity planning associé, ainsi que les infrastructures Cloud (Kubernetes, DevOps) et les outils d'observabilité (Prometheus, Grafana, OpenTelemetry). - Vous possédez une bonne familiarité avec des frameworks de pointe tels que vLLM, SGLang, TensorRT ou des équivalents technologiques du marché. - Vous êtes doté d'un leadership naturel, capable de fédérer autour de décisions techniques complexes tout en affichant d'excellentes capacités de communication et de collaboration. - Vous faites preuve d'adaptabilité et d'une grande curiosité face à l'évolution rapide des technologies, avec une approche résolument orientée impact, résultats et itération rapide. C'est un + - Vous adoptez une approche AI Native au quotidien en exploitant les assistants de code et les outils d'IA générative pour décupler votre productivité et la qualité de vos livrables., Vous disposez d'une solide expérience en développement logiciel (Python, Rust, backend), en systèmes distribués ainsi que dans le déploiement de modèles d'IA en production. - Vous maîtrisez parfaitement les environnements GPU, le capacity planning associé, ainsi que les infrastructures Cloud (Kubernetes, DevOps) et les outils d'observabilité (Prometheus, Grafana, OpenTelemetry). - Vous possédez une bonne familiarité avec des frameworks de pointe tels que vLLM, SGLang, TensorRT ou des équivalents technologiques du marché. - Vous êtes doté d'un leadership naturel, capable de fédérer autour de décisions techniques complexes tout en affichant d'excellentes capacités de communication et de collaboration. - Vous faites preuve d'adaptabilité et d'une grande curiosité face à l'évolution rapide des technologies, avec une approche résolument orientée impact, résultats et itération rapide., Management d'équipe Prometheus Intelligence artificielle Grafana Développement logiciel Veille technologique Batching Kubernetes Python Qualité fédératrice ## Description Au sein de votre équipe #OneTeam - Être le référent technique de l'équipe AI Solutions. Vous définissez et faites évoluer nos produits IA afin de garantir des services performants, fiables et scalables, avec une attention particulière portée à l'infrastructure GPU, à l'optimisation des modèles et à l'excellence opérationnelle. Vos principales responsabilités - Porter les choix d'architecture en tant que référent technique de l'équipe - Concevoir et faire évoluer l'infrastructure nécessaire au déploiement et à l'exploitation des modèles d'IA - Optimiser les performances des modèles (quantization, batching, KV cache, tensor/pipeline parallelism, speculative decoding, etc.) et l'utilisation des ressources GPU (throughput, latency, memory footprint, cost efficiency) - Garantir la fiabilité, la scalabilité et l'observabilité des services en production - Contribuer à la roadmap technique et accompagner sa mise en oeuvre - Promouvoir les bonnes pratiques d'ingénierie (revues de code, qualité, automatisation, CI/CD) - Assurer une veille technologique active sur l'écosystème IA et partager les connaissances au sein de l'équipe - Accompagner les membres de l'équipe dans leur montée en compétences - Remettre en question les solutions existantes afin d'évoluer dans un contexte technologique en constante transformation Votre futur impact Dans 6 mois - Vous aurez pris vos marques en tant que référent technique au sein de l'équipe AI Solutions et aurez commencé à porter les choix d'architecture clés. - Vous aurez appréhendé notre infrastructure GPU et contribué activement à la feuille de route technique. - Vous aurez collaboré à l'optimisation des premiers modèles en production, en améliorant la latence et l'efficacité des ressources. - Vous aurez établi une relation de confiance avec l'équipe pour l'accompagner dans sa montée en compétences au quotidien. - Vous aurez mis en application votre approche pragmatique en poussant de premières itérations rapides selon la culture "fail fast, learn fast" pour maximiser l'impact de nos produits d'intelligence artificielle. Et dans 1 an - Vous aurez consolidé l'infrastructure nécessaire au déploiement des modèles IA à grande échelle, garantissant une observabilité et une fiabilité irréprochables de nos services en production. - Vous aurez pleinement diffusé les bonnes pratiques d'ingénierie et automatisé les workflows via une démarche DevOps et Kubernetes. L'équipe aura gagné en maturité et en vélocité sous votre impulsion technique. - Vous aurez pérennisé notre stack en intégrant les outils les plus performants du marché (vLLM, SGLang, TensorRT) grâce à votre veille active, maintenant OVHcloud à la pointe de l'écosystème de l'IA., Vous adoptez une approche AI Native au quotidien en exploitant les assistants de code et les outils d'IA générative pour décupler votre productivité et la qualité de vos livrables. ## Related Videos - [Developing the Backend with Stefan Lingler, CTO at Shpock](https://www.wearedevelopers.com/videos/100360-developing-the-backend-with-stefan-lingler-cto-at-shpock) - [5 steps for running a Kubernetes environment at scale](https://www.wearedevelopers.com/videos/88-5-steps-for-running-a-kubernetes-environment-at-scale) - [From DevOps to Scaled DevOps: How We’re Rebuilding Continuous Delivery as a Platform](https://www.wearedevelopers.com/videos/100018-from-devops-to-scaled-devops-how-we-re-rebuilding-continuous-delivery-as-a-platform) - [Shipping Faster with Less: Render on Cloud Hosting, AI Workloads, and the Future of DevOps](https://www.wearedevelopers.com/videos/1894-shipping-faster-with-less-render-on-cloud-hosting-ai-workloads-and-the-future-of-devops) - [#90DaysOfDevOps - The DevOps Learning Journey](https://www.wearedevelopers.com/videos/548-90daysofdevops-the-devops-learning-journey) - [DevOps for AI: running LLMs in production with Kubernetes and KubeFlow](https://www.wearedevelopers.com/videos/1222-devops-for-ai-running-llms-in-production-with-kubernetes-and-kubeflow) ## Related Articles - [Navigating the AI Shift](https://www.wearedevelopers.com/magazine/629-navigating-the-ai-shift) - [Dev Digest 121 - AI goes offline](https://www.wearedevelopers.com/magazine/456-dev-digest-121-ai-goes-offline) - [7 Cloud Computing Trends Coming in 2025 for Developers](https://www.wearedevelopers.com/magazine/412-7-cloud-computing-trends-coming-in-2025-for-developers) - [Dev Digest 120 - Apple and peers](https://www.wearedevelopers.com/magazine/455-dev-digest-120-apple-and-peers) - [MLOps And AI Driven Development](https://www.wearedevelopers.com/magazine/82-mlops-and-ai-driven-development) - [Is Software Engineering Over-Saturated?](https://www.wearedevelopers.com/magazine/418-is-software-engineering-over-saturated)