> Markdown version of [/jobs/ext/2366235-senior-devops-h-f](https://www.wearedevelopers.com/jobs/ext/2366235-senior-devops-h-f). Every page supports `.md` or `Accept: text/markdown`. Links point to the HTML versions so they work for humans too. Agent guide: [/agents.md](https://www.wearedevelopers.com/agents.md). --- # Senior DevOps H/F - **Company:** Studio Pionnier D'ubisoft - **Location:** Paris, France - **Experience:** Expert - **Contract:** Permanent contract - **Skills:** Artificial Intelligence, Linux, DevOps, Distributed Systems, Python (Programming Language), Unix Shell, Load Testing, Machine Learning, Network Protocols, Performance Tuning, Scripting, Large Language Models, Reliability of Systems, Kubernetes, Low Latency, TensorRT - **Published:** August 12, 2026 - **Apply:** https://www.hellowork.com/fr-fr/emplois/82263749.html ## About the Role Expérience dans le déploiement, la configuration et l'optimisation des performances de serveurs d'inférence ML modernes (comme Triton Inference Server, vLLM, TensorRT-LLM, etc.).Expérience avérée dans la gestion, la scalabilité et l'automatisation d'environnements Kubernetes de niveau production.Expérience pratique avec des pipelines d'observabilité.Maîtrise de Python, Linux et du scripting shell pour l'automatisation d'infrastructure, le profiling de performance et les frameworks de tests de charge.Bonne compréhension des protocoles réseau (gRPC, HTTP/2), des systèmes distribués et des principes d'infrastructure as code.Bon relationnel et bonne capacité à communiquer en anglaisC'est un plus:Compréhension de base de RustExpérience avec les systèmes de matchmaking à grande échelle ou les contraintes de faible latence typiques des services de jeux multijoueurs en ligne., * Expérience dans le déploiement, la configuration et l'optimisation des performances de serveurs d'inférence ML modernes (comme Triton Inference Server, vLLM, TensorRT-LLM, etc.). * Expérience avérée dans la gestion, la scalabilité et l'automatisation d'environnements Kubernetes de niveau production. * Expérience pratique avec des pipelines d'observabilité. * Maîtrise de Python, Linux et du scripting shell pour l'automatisation d'infrastructure, le profiling de performance et les frameworks de tests de charge. * Bonne compréhension des protocoles réseau (gRPC, HTTP/2), des systèmes distribués et des principes d'infrastructure as code. * Bon relationnel et bonne capacité à communiquer en anglais C'est un plus: * Compréhension de base de Rust * Expérience avec les systèmes de matchmaking à grande échelle ou les contraintes de faible latence typiques des services de jeux multijoueurs en ligne. EUR Machine learning Anglais Intelligence artificielle Shell Linux Kubernetes Optimisation des performances Python Scripting ## Description Optimiser l'inférence des modèles d'IA afin de réduire la latence et améliorer les performances globales, - Assurer le déploiement, l'hébergement et le bon fonctionnement des modèles en production, - Gérer et optimiser la capacité à traiter des milliers de requêtes simultanées (scalabilité et robustesse). - Piloter et maîtriser les coûts d'infrastructure (GPU, ressources cloud, etc.). - Collaborer avec les équipes Data Science, notamment sur la transition entre les phases de training et de mise en production. - Intervenir sur l'infrastructure IT dédiée au machine learning (serveurs, ressources spécialisées). - Améliorer en continu la performance et la fiabilité des systèmes d'inférence. ## Related Videos - [Tour de Force: Open-Source LLM Inference Optimization from Simple to Sophisticated](https://www.wearedevelopers.com/videos/100099-tour-de-force-open-source-llm-inference-optimization-from-simple-to-sophisticated) - [Docker network without Docker](https://www.wearedevelopers.com/videos/1418-docker-network-without-docker) - [From DevOps to Scaled DevOps: How We’re Rebuilding Continuous Delivery as a Platform](https://www.wearedevelopers.com/videos/100018-from-devops-to-scaled-devops-how-we-re-rebuilding-continuous-delivery-as-a-platform) - [Shipping Faster with Less: Render on Cloud Hosting, AI Workloads, and the Future of DevOps](https://www.wearedevelopers.com/videos/1894-shipping-faster-with-less-render-on-cloud-hosting-ai-workloads-and-the-future-of-devops) - [#90DaysOfDevOps - The DevOps Learning Journey](https://www.wearedevelopers.com/videos/548-90daysofdevops-the-devops-learning-journey) - [Efficient deployment and inference of GPU-accelerated LLMs​](https://www.wearedevelopers.com/videos/929-efficient-deployment-and-inference-of-gpu-accelerated-llms) ## Related Articles - [Best Companies to Work For in Paris: Top 25 Companies in 2023 ](https://www.wearedevelopers.com/magazine/190-best-companies-to-work-for-in-paris-top-25-companies-in-2023) - [Dev Digest 121 - AI goes offline](https://www.wearedevelopers.com/magazine/456-dev-digest-121-ai-goes-offline) - [Jobs in Tech: The State of the European Market](https://www.wearedevelopers.com/magazine/575-jobs-in-tech-the-state-of-the-european-market) - [Why Upskilling And Reskilling is Important For Developers](https://www.wearedevelopers.com/magazine/428-why-upskilling-and-reskilling-is-important-for-developers) - [DevOps Engineer Salary [2023]](https://www.wearedevelopers.com/magazine/203-devops-engineer-salary-2023) - [Is Software Engineering Over-Saturated?](https://www.wearedevelopers.com/magazine/418-is-software-engineering-over-saturated)