303 - Ingénieur Data Senior (H/F)

Nicholson SAS
Paris, France
13 days ago

Role details

Contract type
Temporary contract
Employment type
Full-time (> 32 hours)
Experience level
Expert
Experience required
5 years minimum
Working hours
Regular working hours
Job source

Tech stack

Apache HTTP Server Big Data Cloud Computing Information Engineering Extract Transform Load (ETL) DevOps Open Source Technology Prometheus Data Streaming Google Cloud Apache Spark Data Lakes
+6 more
Gitlab-ci Kubernetes OpenText Apache Kafka Apache Nifi Spark Streaming

Job description

Contexte & Objectif de la Mission : Au sein d’un grand groupe média, l’objectif principal est de concevoir et construire le MVP d’une plateforme Data On-Premise basée sur des technologies Open Source.

La plateforme permettra de : Gérer les transformations de données On-Premise et alimenter un Data Lake local.

Servir de plateforme d’ingestion pour le Big Data sur GCP (Cloud Public).

Faciliter la transition du mode Batch vers le Streaming (Temps réel).

Valider la faisabilité de migration de flux ETL legacy (OpenText / Genio).

Responsabilités & Missions Principales : Conception & Déploiement du MVP :

Architecturer et intégrer la plateforme sur un socle existant (Kubernetes, GitLab CI, Prometheus/OpenTelemetry).

Installer et configurer la stack Open Source : Kafka, NiFi, Spark, Iceberg, Trino.

Validation Technique & Cas d’Usage : Migrer quelques flux ETL clés pour valider la valeur de la plateforme.

Déployer des pipelines streaming (Kafka + Spark Structured Streaming).

Mettre en place l’alimentation du Data Lake (Iceberg + Trino) et assurer l’interopérabilité avec GCP.

Collaboration & Documentation : Travailler en synergie avec les équipes Data/IA et DevOps/Infra.

Documenter l’architecture, les choix techniques et transmettre les compétences aux équipes internes.

Requirements

Synthèse de la Mission : Rôle : Ingénieur Data Senior ( > 7 ans d’expérience), Stack Technique & Compétences Requises : Écosystème Data / Open Source : Apache Kafka, Apache NiFi, Apache Spark, Apache Iceberg, Trino.

Environnement Cloud & Infra : GCP, Kubernetes, GitLab CI, Prometheus / OpenTelemetry.

Problématiques : Streaming temps réel, Data Lake On-Premise, migration ETL.

Expérience : > 5 ans en ingénierie de données complexes.

Benefits & conditions

Localisation : Paris ou Rennes (3 jours/semaine sur site, 2 jours en télétravail)

Apply for this position

This job is hosted externally. Click below to view the full posting and apply.

Apply on fr.indeed.com

Good distractions

Talks and stories from around this role — technically off-topic, practically not.

3:28 min

Defining big data and machine learning fundamentals

Ayon Roy · LIVE

2:17 min

Mapping the maturity roadmap for scaled devops adoption

Dominik Krichbaum Dominik Krichbaum · WWC Europe 2026

4:36 min

Hiring passionate software engineers to tackle unprecedented scaling challenges

Dana Lawson Dana Lawson +1 · WWC Europe 2026

2:10 min

Why organizations combine big data and machine learning

Ayon Roy · LIVE

3:18 min

Scaling global network engineering through DevOps culture

Stuart Clark · LIVE

3:09 min

Balancing data science skillings alongside systems engineering rigor

Nico Schmidt · LIVE

Videos

See all

Related articles

See all