Ingénieur Système et Réseau IGD (dominante Hadoop)

Ipanema Technology
Canton de Nancy-2, France
yesterday

Role details

Contract type
Permanent contract
Employment type
Full-time (> 32 hours)
Working hours
Regular working hours
Languages
French
Experience level
Junior

Job location

Canton de Nancy-2, France

Tech stack

Airflow
Amazon Web Services (AWS)
Big Data
Information Systems
Databases
Continuous Integration
Shard (Database Architecture)
Debian Linux
Linux
Hadoop
Hive
MySQL
Open Source Technology
RabbitMQ
Red Hat Enterprise Linux - RHEL
Ansible
Prometheus
Zabbix
Apache Yarn
Grafana
GIT
Kubernetes
Deployment Automation
Cassandra
Kafka
Spark Streaming
Puppet
Terraform
Docker

Job description

Vous intégrez une équipe en charge de l'infrastructure de gestion de la donnée d'un acteur bancaire en ligne à très forte volumétrie, sur un système d'information majoritairement construit en briques open source.

L'équipe couvre l'intégralité du cycle de vie des plateformes data ? conception, déploiement, administration, supervision ? sans séparation build/run ni logique de procédures cloisonnées. Vous n'êtes pas administrateur de bases de données au sens classique : vous concevez, scalez, sécurisez et industrialisez les moteurs de données. L'optimisation de requêtes reste marginale.

Volumétrie de référence : 180 instances MySQL avec sharding, cluster Hadoop d'environ 3 Po, stockage objet S3 de plusieurs pétaoctets.

Vos missions : Traitement N3 des incidents de production sur l'ensemble des briques de gestion de la donnée

Industrialisation des moteurs de données via déploiement automatisé (Terraform, sur VM pré-outillées EDR/hardening)

Conception et exploitation des mécanismes de haute disponibilité, scalabilité, réplication et sharding à l'échelle

Définition et exécution des stratégies de backup/restauration sur gros volumes

Traitement de l'obsolescence : montée de version MySQL vers 8.x sur l'ensemble du parc

Qualification et industrialisation de nouvelles briques techniques

Pilotage de la couche système sous-jacente et des couches d'exposition (ex. Consul)

Suivi des KPIs de production et mise en ?uvre d'actions correctives

Traitement des sujets de sécurité sur les plateformes data

Interface quotidienne avec les équipes de développement et l'infrastructure

Environnement technique

Requirements

Socle commun : Linux (Debian/RHEL) niveau confirmé à avancé, Terraform/Ansible/Puppet, CI/CD, Git, Docker, Kubernetes (RKE2) en trajectoire GitOps (ArgoCD)

Bigdata/Hadoop (c?ur du poste) : Hadoop, Hive, Hue, Yarn, Zeppelin, Spark Streaming ? niveau confirmé

Autres : Cassandra, Kafka, Airflow niveau confirmé ; MySQL niveau avancé ; suite ELK

Supervision : Zabbix, Prometheus, Grafana, Loki, Expérience confirmée sur l'écosystème Hadoop (Hadoop, Hive, Hue, Yarn, Zeppelin, Spark Streaming) ? c'est le c?ur du poste, pas une brique parmi d'autres. On attend une pratique réelle de l'administration et du dépannage de cluster Hadoop en production, pas une simple utilisation applicative

Solide culture infrastructure système Linux (Debian/RHEL) et appétence marquée pour l'open source

Expérience réelle et vécue de la production ? vous avez géré de vrais incidents, pas seulement exécuté des procédures cadrées. C'est le critère le plus discriminant du poste

Maîtrise conceptuelle de la gestion de la donnée à l'échelle : scalabilité, haute disponibilité, sharding, fonctionnement des brokers (Kafka, RabbitMQ)

Capacité à expliquer et dépanner en profondeur un cluster Hadoop et les briques associées en condition dégradée ? pas seulement à utiliser des outils

Posture transversale complète : conception, déploiement, administration, supervision, sur l'ensemble des briques data dont Hadoop. Toute posture silo (DBA pur, ops système pur) est éliminatoire

Veille technologique active, culture infrastructure générale

Séniorité non bloquante : un profil junior avec des concepts Hadoop/data solides et de la motivation réelle est recevable

Apply for this position