> Markdown version of [/jobs/ext/2687855-cloud-lead-sre-stockage-h-f](https://www.wearedevelopers.com/jobs/ext/2687855-cloud-lead-sre-stockage-h-f). Every page supports `.md` or `Accept: text/markdown`. Links point to the HTML versions so they work for humans too. Agent guide: [/agents.md](https://www.wearedevelopers.com/agents.md). --- # Cloud - Lead Sre Stockage H/F - **Company:** Cnd - **Location:** Le Kremlin-Bicêtre, France - **Experience:** Expert - **Contract:** Permanent contract - **Skills:** Amazon S3, Cloud Computing, Linux, Distributed Systems, Python (Programming Language), Network Layer, Open Source Technology, Performance Tuning, Ansible, Prometheus, Ceph (Software), Data Processing, Grafana, Terraform, Programming Languages - **Published:** September 3, 2026 - **Apply:** https://www.hellowork.com/fr-fr/emplois/82939876.html ## About the Role Nous cherchons un expert stockage distribué : soit 10+ ans d'expérience en production, soit doctorat en systèmes distribués/stockage avec expérience significative en production de solutions à grande échelle.Vous possédez de l'expérience professionnelle :- Exploitation SRE de solutions de stockage distribué à grande échelle (Ceph, Longhorn, stack S3 ou équivalent) : déploiement, exploitation, optimisation ; - Dimensionnement de plateforme de stockage (IOPS, bande passante, latence) et arbitrages performance/coût/résilience ; - Observabilité avancée de stockage distribué avec alertes et métrologie ; - Tests de résilience et chaos engineering appliqué au stockage : perte de disques, partitions réseau, corruption de données ; - Gestion d'incidents en production (niveau N3/N4) et participation aux astreintes ; - Expérience de la culture SRE : pilotage par SLO/SLI, RETEX, amélioration continue.Vous disposez également des compétences techniques suivantes :- Expertise avancée sur au moins une solution de stockage distribuée bloc ou objet ; - Maîtrise de Linux avancé (optimisation performances, tuning kernel) et des couches réseau sous-jacentes ; - Maîtrise d'au moins un langage de programmation (Go, Python) et d'infrastructure-as-code (Terraform, Ansible) ; - Maîtrise d'une stack d'observabilité (Prometheus, Grafana, Loki) et des outils/méthodes de métrologie ; - Compréhension des fondamentaux théoriques : réplication, erasure coding, consensus distribué, cohérence sans consensus, théorème CAP ; - Capacité à concevoir des architectures résilientes face aux contraintes réseau (bande passante limitée, latence élevée, coupures) ; - Très bonne connaissance sécurité : multi-tenant, chiffrement at-rest/in-transit, gestion des secrets, capacité à dialoguer avec une chaîne SSI.Vous êtes :- Rigoureux : Capacité à concevoir et maintenir des infrastructures critiques avec une attention méticuleuse aux détails, particulièrement dans les aspects de sécurité et de reproductibilité ;- Innovant : Capacité à proposer des solutions techniques avancées et à implémenter des bonnes pratiques ;- Ancré dans une culture d'analyse factuelle et d'amélioration continue ;Atouts appréciés :- Expérience d'environnements multi-sites / multi-régions ;- Expérience avec des environnements avec de fortes exigences de disponibilité ;- Connaissance de SecNumCloud et IGI 1300 ;- Contributions open source, Nous cherchons un expert stockage distribué : soit 10+ ans d'expérience en production, soit doctorat en systèmes distribués/stockage avec expérience significative en production de solutions à grande échelle., Maîtrise d'au moins un langage de programmation (Go, Python) et d'infrastructure-as-code (Terraform, Ansible) ; - Maîtrise d'une stack d'observabilité (Prometheus, Grafana, Loki) et des outils/méthodes de métrologie ; - Compréhension des fondamentaux théoriques : réplication, erasure coding, consensus distribué, cohérence sans consensus, théorème CAP ; - Capacité à concevoir des architectures résilientes face aux contraintes réseau (bande passante limitée, latence élevée, coupures) ; - Très bonne connaissance sécurité : multi-tenant, chiffrement at-rest/in-transit, gestion des secrets, capacité à dialoguer avec une chaîne SSI. Vous êtes : - Rigoureux : Capacité à concevoir et maintenir des infrastructures critiques avec une attention méticuleuse aux détails, particulièrement dans les aspects de sécurité et de reproductibilité ; - Innovant : Capacité à proposer des solutions techniques avancées et à implémenter des bonnes pratiques ; - Ancré dans une culture d'analyse factuelle et d'amélioration continue ; Atouts appréciés : - Expérience d'environnements multi-sites / multi-régions ; - Expérience avec des environnements avec de fortes exigences de disponibilité ; - Connaissance de SecNumCloud et IGI 1300 ; - Contributions open source EUR Ansible Prometheus Sauvegarde des données Linux Grafana SSI Elaboration d'un plan de reprise d'activité Optimisation des performances Rigueur et méthode Python ## Description En tant que Lead SRE Stockage, vous concevez, déployez et opérez l'infrastructure de stockage distribuée. Vos missions incluent : - Déployer et opérer le stockage bloc et objet au niveau régional puis étendre vers le multi-régions ; contribuer aux choix technologiques (e.g., Ceph ou alternatives) ; - Garantir l'isolation multi-tenant, la résilience et les performances du stockage distribué ; - Concevoir et opérer une architecture multi-régions résiliente face aux contraintes réseau (bande passante limitée, latence, coupures) en tenant compte du théorème CAP ; - Mettre en oeuvre les procédures de backup, restauration et de PRA ; - Déployer et opérer la stack d'observabilité sur vos périmètres ; - Conduire l'exploitation par les SLO, error budgets et RETEX ; - Participer à la gestion d'incidents (niveau N3/N4) et aux astreintes ; - Équipe : encadrer techniquement les ingénieurs stockage ; contribuer au recrutement et à la montée en compétences., Exploitation SRE de solutions de stockage distribué à grande échelle (Ceph, Longhorn, stack S3 ou équivalent) : déploiement, exploitation, optimisation ; - Dimensionnement de plateforme de stockage (IOPS, bande passante, latence) et arbitrages performance/coût/résilience ; - Observabilité avancée de stockage distribué avec alertes et métrologie ; - Tests de résilience et chaos engineering appliqué au stockage : perte de disques, partitions réseau, corruption de données ; - Gestion d'incidents en production (niveau N3/N4) et participation aux astreintes ; - Expérience de la culture SRE : pilotage par SLO/SLI, RETEX, amélioration continue. Vous disposez également des compétences techniques suivantes : - Expertise avancée sur au moins une solution de stockage distribuée bloc ou objet ; - Maîtrise de Linux avancé (optimisation performances, tuning kernel) et des couches réseau sous-jacentes ## Related Videos - [Dev & Test in the Cloud? Deploy your cloud environments with Ansible & Terraform](https://www.wearedevelopers.com/videos/1607-dev-test-in-the-cloud-deploy-your-cloud-environments-with-ansible-terraform) - [SRE Methods In an Agency Environment](https://www.wearedevelopers.com/videos/348-sre-methods-in-an-agency-environment) - [5 steps for running a Kubernetes environment at scale](https://www.wearedevelopers.com/videos/88-5-steps-for-running-a-kubernetes-environment-at-scale) - [Docker network without Docker](https://www.wearedevelopers.com/videos/1418-docker-network-without-docker) - [Embracing the Hybrid Cloud: Unlocking Success with Ansible](https://www.wearedevelopers.com/videos/932-embracing-the-hybrid-cloud-unlocking-success-with-ansible) - [#90DaysOfDevOps - The DevOps Learning Journey](https://www.wearedevelopers.com/videos/548-90daysofdevops-the-devops-learning-journey) ## Related Articles - [Best Companies to Work For in Paris: Top 25 Companies in 2023 ](https://www.wearedevelopers.com/magazine/190-best-companies-to-work-for-in-paris-top-25-companies-in-2023) - [Best Companies to Work For in France: Top 25 Companies in 2023 ](https://www.wearedevelopers.com/magazine/189-best-companies-to-work-for-in-france-top-25-companies-in-2023) - [What Are The Top Skills Required For Azure Developers?](https://www.wearedevelopers.com/magazine/77-what-are-the-top-skills-required-for-azure-developers) - [How We Built a Worry-Free System That Runs for 10+ Years – And What We’d Do Again](https://www.wearedevelopers.com/magazine/751-how-we-built-a-worry-free-system-that-runs-for-10-years-and-what-we-d-do-again) - [7 Cloud Computing Trends Coming in 2025 for Developers](https://www.wearedevelopers.com/magazine/412-7-cloud-computing-trends-coming-in-2025-for-developers) - [Is Software Engineering Over-Saturated?](https://www.wearedevelopers.com/magazine/418-is-software-engineering-over-saturated)