Data Engineer H/F

Groupe Alten
Lille, France
2 days ago
Apply on www.hellowork.com
Prepare application

Role details

Contract type
Permanent contract
Employment type
Full-time (> 32 hours)
Experience level
Experienced
Experience required
4 years minimum
Working hours
Regular working hours
Languages
English

Tech stack

Airflow Amazon Web Services Microsoft Azure BigQuery Cloud Computing Databases Continuous Integration Extract Transform Load (ETL) DevOps Apache Hive Machine Learning NoSQL
+14 more
Prometheus SQL Databases Management of Software Versions Planning Software Google Cloud Snowflake Apache Spark Gitlab Git Data Lakes Pyspark Jenkins Amazon Redshift Databricks

Job description

Concevoir et déployer des pipelines de données robustes et scalables à l’aide de Databricks, PySpark et DBT, pour alimenter des environnements d’analyse et de machine learning.

  • Optimiser les performances des traitements ETL/ELT en exploitant les bonnes pratiques de data modeling (schémas en étoile, en flocon, etc.) et les capacités distribuées de Spark.
  • Collaborer avec les Data Scientists et les équipes métiers pour comprendre les besoins et livrer des jeux de données fiables, documentés et prêts à l’emploi.
  • Automatiser le déploiement et la maintenance des pipelines via des outils CI/CD (GitLab, Jenkins, etc.) et garantir leur monitoring (Airflow, Prometheus, etc.).
  • Contribuer à l’évolution de l’architecture data du groupe, en intégrant des solutions cloud (AWS, Azure ou GCP) et en veillant à la conformité RGPD et aux normes de sécurité.
  • Intervenir en tant qu’expert technique pour résoudre les problèmes complexes liés à la qualité, la latence ou la volumétrie des données.
  • Documenter les processus, les schémas de données et les bonnes pratiques pour faciliter la maintenance et l’onboarding des nouveaux membres de l’équipe.

Requirements

Formation / Expérience Diplômé d’une école d’ingénieurs ou titulaire d’un Master (Bac +5) Minimum 4 ans d’expérience (hors alternance)Compétences techniques Maîtrise de PySpark (optimisation, UDFs, DataFrames).Expérience confirmée avec Databricks (Delta Lake, Spark SQL, clusters).Pratique avancée de DBT (modélisation, tests, documentation).Connaissance des bases de données (SQL, NoSQL) et des entrepôts cloud (Snowflake, BigQuery, Redshift).Familiarité avec les outils de versioning (Git) et les environnements DevOps.Qualités personnelles Capacité à travailler en équipe pluridisciplinaire.Rigueur, autonomie et sens de l’innovation.Excellente communication technique et fonctionnelle.Langues et mobilité Maîtrise professionnelle de l’anglais, * Diplômé d’une école d’ingénieurs ou titulaire d’un Master (Bac +5)

  • Minimum 4 ans d’expérience (hors alternance)

Compétences techniques

  • Maîtrise de PySpark (optimisation, UDFs, DataFrames).
  • Expérience confirmée avec Databricks (Delta Lake, Spark SQL, clusters).
  • Pratique avancée de DBT (modélisation, tests, documentation).
  • Connaissance des bases de données (SQL, NoSQL) et des entrepôts cloud (Snowflake, BigQuery, Redshift).
  • Familiarité avec les outils de versioning (Git) et les environnements DevOps.

Qualités personnelles

  • Capacité à travailler en équipe pluridisciplinaire.
  • Rigueur, autonomie et sens de l’innovation.
  • Excellente communication technique et fonctionnelle.

Langues et mobilité

  • Maîtrise professionnelle de l’anglais

EUR

Cluster Prometheus Anglais ETL Google cloud platform SQL Modélisation des données Git Jenkins Autonomie NoSQL Logiciels de gestion de versions

About the company

Leader de l’Ingénierie et des IT Services, présent dans plus de 30 pays, le groupe ALTEN accompagne la stratégie de développement de ses clients dans les domaines de l’innovation, de la R&D et des systèmes d’information technologiques.

Plus qu’un poste, découvrez l’aventure qui vous attend au sein d’une entreprise engagée.

Pour renforcer son pôle Data & Analytics, la Direction des Solutions Technologiques du groupe ALTEN, leader mondial de l’ingénierie et du conseil en technologies, recrute un Data Engineer senior spécialisé en modélisation de données et traitement massivement parallèle. Ce poste, placé sous la responsabilité du Responsable Data Platform, s’inscrit dans une dynamique d’innovation et de transformation digitale pour accompagner nos clients dans la valorisation de leurs données., Leader de l’Ingénierie et des IT Services, présent dans plus de 30 pays, le groupe ALTEN accompagne la stratégie de développement de ses clients dans les domaines de l’innovation, de la R&D et des systèmes d’information technologiques. Plus qu’un poste, découvrez l’aventure qui vous attend au sein d’une entreprise engagée.

Apply for this position

This job is hosted externally. Click below to view the full posting and apply.

Apply on www.hellowork.com
Prepare application

Good distractions

Talks and stories from around this role — technically off-topic, practically not.

3:09 min

Balancing data science skillings alongside systems engineering rigor

Nico Schmidt · LIVE

6:21 min

Investigating push inefficiencies with upstream Git experts

Jonathan Creamer · Coffee With Developers

2:37 min

Comparing traditional SQL tables versus NoSQL non-tabular databases

Stanimira Vlaeva · JS Congress

2:17 min

Mapping the maturity roadmap for scaled devops adoption

Dominik Krichbaum Dominik Krichbaum · World Congress 2026 Europe

1:34 min

Bringing diverse skills to industrial data science roles

Katja Träumner

56 sec

Favorite git commands and the importance of patch commits

Eileen Uchitelle Eileen Uchitelle +1 · Coffee With Developers

Videos

See all

Related articles

See all