Ingénieur de Production / Site Reliability Engineering (SRE)

RIDCHA DATA
Canton de Valbonne, France
yesterday

Role details

Contract type
Permanent contract
Employment type
Full-time (> 32 hours)
Working hours
Regular working hours
Languages
French
Experience level
Intermediate

Job location

Canton de Valbonne, France

Tech stack

Airflow
Amazon Web Services (AWS)
JIRA
Bash
Cloud Computing
Continuous Integration
Linux
DevOps
MySQL
Routing
Nginx
Public Key Infrastructure
Redis
Reliability Engineering
Site Reliability Engineering Practices
Ansible
Wide Area Networks
Private Cloud Environment
Scripting (Bash/Python/Go/Ruby)
Transport Layer Security
Load Balancing
Grafana
Gitlab-ci
Kubernetes
Rancher
Rundeck
Docker

Job description

Contexte de la missionDans le cadre de l'exploitation d'une prestation critique hébergée sur un Cloud privé, nous recherchons un Ingénieur de Production / Site Reliability Engineering (SRE) afin d'intégrer une équipe de 5 ingénieurs en charge du maintien en conditions opérationnelles (MCO) d'une plateforme stratégique pilotée par un ministère.

Vous contribuerez à garantir la disponibilité, la fiabilité et la performance des applications en production tout en accompagnant la transformation vers un modèle SRE et Cloud.

Vos missionsAssurer le MCO des applications et infrastructures en environnement Cloud privé.

Garantir le respect des SLA et le traitement des tickets Jira.

Superviser les plateformes, assurer le monitoring et l'observabilité des systèmes.

Analyser les incidents, identifier les causes racines et mettre en ?uvre des actions correctives durables.

Automatiser les opérations d'exploitation via Ansible, scripts Bash et outils DevOps.

Participer aux déploiements applicatifs et infrastructures (CI/CD, GitOps).

Gérer les environnements Recette, Préproduction et Production.

Administrer les plateformes Docker et Kubernetes.

Optimiser les performances, la disponibilité et la résilience des services.

Maintenir et enrichir la documentation d'exploitation.

Collaborer avec les équipes de développement, infrastructure et Service Delivery., Rundeck

Rancher RKE2

NGINX

Vault

Morpheus CMP

S3

Airflow

Réseau (LAN/WAN, routage, Load Balancer, TLS, PKI), LivrablesRespect des SLA et traitement des tickets Jira.

Documentation d'exploitation.

Automatisation des procédures.

Mise en production des évolutions.

Suivi de la disponibilité et des performances des plateformes.

Requirements

Compétences indispensablesAnsible

Docker

MySQL

Observabilité / Monitoring

Linux

GitLab CI / GitOps

Bash / scripting

Kubernetes

Gestion des incidents de production

Français courant

Compétences appréciéesZabbix

Grafana

OpenSearch

Redis, Soft SkillsExcellente capacité d'analyse et de résolution d'incidents.

Résistance au stress et gestion des priorités.

Esprit d'équipe et sens du service.

Forte autonomie.

Bonnes capacités de communication.

Force de proposition et démarche d'amélioration continue.

Capacité à évoluer dans un environnement critique., Minimum 3 ans d'expérience en tant qu'Ingénieur Production, DevOps ou SRE sur des environnements critiques.

Solide expérience en exploitation de plateformes Linux conteneurisées.

Maîtrise des outils d'automatisation, de monitoring et de déploiement.

Expérience des environnements Cloud privé et des pratiques SRE.

Bonne compréhension des enjeux de disponibilité, de sécurité et de performance.

Apply for this position