Site Reliability Engineer Expérimenté CDI H/F

Groupe Alten
Valbonne, France
5 days ago
Apply on www.hellowork.com
Prepare application

Role details

Contract type
Permanent contract
Employment type
Full-time (> 32 hours)
Experience level
Expert
Working hours
Regular working hours

Tech stack

Agile Methodology Amazon Web Services Systems Engineering Microsoft Azure Bash Shell Unix Databases Continuous Integration Linux DevOps Github Python (Programming Language)
+20 more
NoSQL Performance Tuning Cloud Services Ansible Prometheus SQL Databases Datadog Scripting Google Cloud Grafana Mttr Reliability of Systems Git Gitlab-ci Kubernetes Terraform Docker Elk Stack Jenkins Microservices

Job description

En tant que Site Reliability Engineer (SRE), vous jouerez un rôle clé dans le maintien, l’optimisation et la sécurisation des infrastructures informatiques et des systèmes de production. Vous travaillerez en collaboration avec les équipes de développement, d’infrastructure et d’opérations pour garantir une disponibilité et une résilience maximales des services et applications critiques., Maintien en conditions opérationnelles des systèmes et des applications en production, en optimisant leur disponibilité, performance et évolutivité.

  • Automatisation des tâches répétitives et des processus de déploiement, de surveillance et d’alerting.
  • Conception et mise en oeuvre de solutions permettant d’améliorer la fiabilité des systèmes et de réduire le taux de pannes.
  • Analyse des incidents et gestion des urgences, avec pour objectif de diminuer le Mean Time To Recovery (MTTR) et d’accroître la résilience.
  • Optimisation des performances des applications et de l’infrastructure, notamment via la gestion des capacités et des coûts.
  • Collaboration avec les équipes de développement pour favoriser une approche DevOps et intégrer les pratiques SRE dès les phases de conception.
  • Création et suivi de métriques pour mesurer la fiabilité et les performances des systèmes (SLI, SLO, SLA).
  • Veille technologique pour assurer l’amélioration continue des outils et des processus SRE.

Requirements

Compétences requises:Expérience en ingénierie système : Linux/Unix, gestion de serveurs, stockage, et réseaux.Maîtrise des outils de monitoring et d’alerting (ex. : Prometheus, Grafana, Datadog, ELK Stack).Compétences en automatisation : scripting (Python, Bash, etc.), outils de CI/CD (ex. : Jenkins, GitLab CI, GitHub Actions), et infrastructure-as-code (Terraform, Ansible).Expérience avec les environnements cloud : AWS, GCP, Azure ou autres services cloud, ainsi que les architectures de microservices et conteneurs (Docker, Kubernetes).Compétences en bases de données : administration et optimisation de bases SQL et NoSQL.Capacité à gérer les incidents : compétences en diagnostic et résolution de pannes dans un environnement de production.Bonnes compétences en communication pour collaborer avec des équipes pluridisciplinaires et documenter les processus et solutions.Compétences bonusExpérience en tant que DevOps ingénieur système ou développeur logicielConnaissance des méthodologies de développement agile et des pratiques DevOpsParticipation à la mise en place de processus d’observabilité, de monitoring et de gestion des incidentsExpérience dans la gestion de la disponibilité et de la performance Résistance au stress et capacité à travailler efficacement en cas d’incidents critiques., * Expérience en ingénierie système : Linux/Unix, gestion de serveurs, stockage, et réseaux.

  • Maîtrise des outils de monitoring et d’alerting (ex. : Prometheus, Grafana, Datadog, ELK Stack).
  • Compétences en automatisation : scripting (Python, Bash, etc.), outils de CI/CD (ex. : Jenkins, GitLab CI, GitHub Actions), et infrastructure-as-code (Terraform, Ansible).
  • Expérience avec les environnements cloud : AWS, GCP, Azure ou autres services cloud, ainsi que les architectures de microservices et conteneurs (Docker, Kubernetes).
  • Compétences en bases de données : administration et optimisation de bases SQL et NoSQL.
  • Capacité à gérer les incidents : compétences en diagnostic et résolution de pannes dans un environnement de production.
  • Bonnes compétences en communication pour collaborer avec des équipes pluridisciplinaires et documenter les processus et solutions.

Compétences bonus

  • Expérience en tant que DevOps ingénieur système ou développeur logiciel
  • Connaissance des méthodologies de développement agile et des pratiques DevOps
  • Participation à la mise en place de processus d’observabilité, de monitoring et de gestion des incidents
  • Expérience dans la gestion de la disponibilité et de la performance
  • Résistance au stress et capacité à travailler efficacement en cas d’incidents critiques.

EUR

Ansible Prometheus Bash ELK Google cloud platform SQL AWS Linux Grafana Git Jenkins Kubernetes Python Terraform Scripting UNIX NoSQL Monitoring Docker

Benefits & conditions

Type de contrat: CDI, temps plein. PAS DE FULL REMOTE POSSIBLE.

About the company

ALTEN Sophia Antipolis intervient auprès des grands acteurs de l’IT de la technopole. Nous sommes parmi les leaders du conseil en ingénierie et technologie. Fort de nos 37 000 collaborateurs et de notre implantation dans plus de 28 pays, nous apportons des solutions innovantes pour contribuer aux projets et au développement de nos clients issus de secteurs d’activité variés.

Apply for this position

This job is hosted externally. Click below to view the full posting and apply.

Apply on www.hellowork.com
Prepare application

Good distractions

Talks and stories from around this role — technically off-topic, practically not.

2:27 min

Structuring agile and interdisciplinary engineering teams

Oliver Zimmert · LIVE

2:03 min

Microsoft integrating native Unix coreutils into Windows environments

Chris Heilmann +2 · LIVE

3:08 min

Aligning engineering processes with core business impact metrics

Chris Riley · World Congress 2021

6:21 min

Investigating push inefficiencies with upstream Git experts

Jonathan Creamer · Coffee With Developers

2:04 min

Defining timestamps and the international standard format

Denny Biasiolli Denny Biasiolli · Europe 2026 Virtual

3:07 min

Establishing service level agreements directly for internal platforms

Pawel Piwosz · LIVE

Videos

See all

Related articles

See all