> Markdown version of [/jobs/ext/3182937-site-reliability-engineer-network-observability-f-h](https://www.wearedevelopers.com/jobs/ext/3182937-site-reliability-engineer-network-observability-f-h). Every page supports `.md` or `Accept: text/markdown`. Links point to the HTML versions so they work for humans too. Agent guide: [/agents.md](https://www.wearedevelopers.com/agents.md). --- # Site Reliability Engineer - Network Observability - F/H - **Company:** OVHCloud - **Location:** Paris, France (Remote available) - **Experience:** Starter - **Contract:** Temporary contract - **Skills:** Systems Engineering, Cloud Engineering, Continuous Integration, DevOps, Elasticsearch, Python (Programming Language), Ansible, Prometheus, Scripting, Grafana, Kubernetes, Puppet, Terraform, Docker, Golang - **Published:** September 14, 2026 - **Apply:** https://www.indeed.com/viewjob?jk=ff2f827f17a5e9cb ## About the Role * Vous justifiez d'une expérience confirmée en administration ou ingénierie système. * Vous maîtrisez Kubernetes, Docker et la philosophie Cloud Native. * Vous disposez d'une solide expérience sur les chaînes de CI/CD et maîtrisez au moins un outil de déploiement (Ansible, Terraform, Puppet,...). * Vous maîtrisez un ou plusieurs langages de scripting (Python, Golang...). * Vous possédez de solides connaissances sur les outils de supervision et d'observabilité (Prometheus, Grafana, Elasticsearch). * Vous faites preuve d'un excellent esprit d'équipe, d'un bon sens de la collaboration et vous vous intégrez rapidement au sein d'un collectif. C'est un + * Une première expérience ou une appétence particulière pour les problématiques d'infrastructure réseau à très grande échelle est un véritable atout. ## Description Site Reliability Engineer - Network Observability - F/H/N Au sein de votre équipe #OneTeam * Rejoindre le département Network & Infrastructure, qui façonne et sécurise l'infrastructure globale d'OVHcloud. * Intégrer l'équipe en charge des outils d'observabilité réseau, un périmètre critique couvrant plus de 500 000 serveurs, 5 millions d'IP publiques et 40 000 équipements réseau. Vos principales responsabilités * Maintenir, moderniser et faire évoluer les outils internes de supervision et de monitoring réseau. * Participer aux rotations d'astreinte et garantir la haute disponibilité, la fiabilité et la sécurité des outils d'observabilité. * Contribuer à la culture DevOps/SRE de l'équipe à travers les bonnes pratiques et l'amélioration continue des processus d'exploitation. * Collaborer avec les membres de l'équipe et les experts réseau afin de concevoir des solutions adaptées aux besoins du terrain. * Piloter ou contribuer à des projets d'amélioration continue (LEAN) pour renforcer la qualité de service et la résilience des infrastructures. * Participer aux rituels Agiles de l'équipe et favoriser le partage de connaissances. L'environnement technique s'appuie notamment sur : Kubernetes, Docker, Prometheus, Grafana, Elasticsearch, Ansible, Terraform, Python, Golang, CI/CD. Votre futur impact Dans 6 mois * Vous aurez pris en main l'écosystème d'observabilité réseau et participerez activement à la maintenance et à la modernisation des outils de supervision. * Vous serez parfaitement intégré au collectif, à la culture SRE et prendrez part aux rotations d'astreinte en toute sérénité. Et dans 1 an * Vous serez autonome sur la gestion et l'évolution des outils d'observabilité critiques. * Vous jouerez un rôle moteur dans les projets LEAN et dans la mise en place de solutions d'automatisation avancées, impactant directement la résilience de l'infrastructure globale d'OVHcloud.