Ingénieur DevOps - Sre - Observabilité H/F
- Discuss this with your agent
- Open in Claude
- Open in ChatGPT
Prepare application
- Draft this with your agent
- Open in Claude
- Open in ChatGPT
Role details
Tech stack
+4 more
Job description
Garantir la disponibilité et la résilience des plateformes.
- Automatiser les processus d’exploitation et de déploiement (CI/CD, IaC).
- Définir et mettre en oeuvre les standards SRE (SLI/SLO/SLA, error budget).
- Industrialiser les pratiques DevOps.
- Développer, exploiter et faire évoluer les plateformes d’observabilité (métriques, logs, traces, alerting).
- Superviser les infrastructures et applications critiques.
- Réduire le MTTR et améliorer la gestion des incidents (post-mortems, runbooks).
- Accompagner et former les équipes métier non expertes sur les bonnes pratiques observabilité, un vrai rôle de pédagogue, pas seulement d’exécutant technique.
- Produire la documentation technique, les dashboards Grafana, les runbooks et les rapports d’exploitation.
Requirements
5 ans d’expérience minimum en DevOps / SRE / Observabilité.
- Expérience en grands comptes à forts enjeux de disponibilité (banque, assurance, télécom, cloud privé).
- Culture SRE solide et outillée : SLO/SLI, error budget, gestion des incidents, post-mortems.
- Culture observabilité forte et outil-indépendante (peu importe l’outil APM en place - Instana, Dynatrace, Datadog…ce qui compte c’est la maîtrise des concepts métriques/logs/traces).
- Excellent relationnel, sens de la pédagogie et de l’écoute : capacité avérée à embarquer des équipes non expertes, à vulgariser, à instaurer la confiance.
- Autonomie, rigueur, capacité à prendre du recul et à monter en responsabilité vers une posture de gouvernance/stratégie observabilité à terme.
Stack technique
Prometheus / Grafana / Mimir / Tempo / Loki · Kubernetes / K3s · Terraform · Ansible · Jenkins / GitLab CI · Docker · Python / Bash · (Instana ou équivalent APM apprécié mais non bloquant)
Savoir-être
Un profil qui sait autant opérer et fiabiliser les systèmes que embarquer et rassurer les équipes métier. Quelqu’un qui parle SRE et observabilité couramment, mais surtout quelqu’un dont le relationnel ne sera jamais le point faible - c’est un critère éliminatoire sur cette mission.
Environnement de travail, Profil recherchéProfil recherché5 ans d’expérience minimum en DevOps / SRE / Observabilité.Expérience en grands comptes à forts enjeux de disponibilité (banque, assurance, télécom, cloud privé).Culture SRE solide et outillée : SLO/SLI, error budget, gestion des incidents, post-mortems.Culture observabilité forte et outil-indépendante (peu importe l’outil APM en place Dynatrace, Datadog…ce qui compte c’est la maîtrise des concepts métriques/logs/traces).Excellent relationnel, sens de la pédagogie et de l’écoute : capacité avérée à embarquer des équipes non expertes, à vulgariser, à instaurer la confiance.Autonomie, rigueur, capacité à prendre du recul et à monter en responsabilité vers une posture de gouvernance/stratégie observabilité à terme., * 5 ans d’expérience minimum en DevOps / SRE / Observabilité.
- Expérience en grands comptes à forts enjeux de disponibilité (banque, assurance, télécom, cloud privé).
- Culture SRE solide et outillée : SLO/SLI, error budget, gestion des incidents, post-mortems.
- Culture observabilité forte et outil-indépendante (peu importe l’outil APM en place Dynatrace, Datadog…ce qui compte c’est la maîtrise des concepts métriques/logs/traces).
- Excellent relationnel, sens de la pédagogie et de l’écoute : capacité avérée à embarquer des équipes non expertes, à vulgariser, à instaurer la confiance.
- Autonomie, rigueur, capacité à prendre du recul et à monter en responsabilité vers une posture de gouvernance/stratégie observabilité à terme.
EUR
Ansible Prometheus Bash Pédagogie Grafana Git Création d’une base documentaire Jenkins Kubernetes Python Autonomie Terraform Docker
Benefits & conditions
Lieu de la mission : La Défense (Hauts-de-Seine)
- Télétravail : 3 jours/semaine (2 jours de présentiel sur site)
- Astreintes : à préciser selon organisation client (rotation à définir)
- Démarrage : dès que possible
- Durée : à préciser (mission initiale + reconductions)
- Rythme : journée standard, environnement grand compte avec fortes exigences de disponibilité (24/7 selon périmètre), Taux journalier :Salaire selon profil
Apply for this position
This job is hosted externally. Click below to view the full posting and apply.
Prepare application
- Draft this with your agent
- Open in Claude
- Open in ChatGPT
Good distractions
Talks and stories from around this role — technically off-topic, practically not.
Moments
Explore playlistsVideos
See allRelated articles
See all
Best Companies to Work For in Paris: Top 25 Companies in 2023
Fully Remote Software Engineer Jobs
How We Built a Worry-Free System That Runs for 10+ Years – And What We’d Do Again
Is Software Engineering Over-Saturated?