> Markdown version of [/jobs/ext/3033459-data-engineer-h-f](https://www.wearedevelopers.com/jobs/ext/3033459-data-engineer-h-f). Every page supports `.md` or `Accept: text/markdown`. Links point to the HTML versions so they work for humans too. Agent guide: [/agents.md](https://www.wearedevelopers.com/agents.md). --- # Data Engineer H/F - **Company:** Groupe Alten - **Location:** Lille, France - **Experience:** Experienced - **Contract:** Permanent contract - **Skills:** Airflow, Amazon Web Services, Microsoft Azure, BigQuery, Cloud Computing, Databases, Continuous Integration, Extract Transform Load (ETL), DevOps, Apache Hive, Machine Learning, NoSQL, Prometheus, SQL Databases, Management of Software Versions, Planning Software, Google Cloud, Snowflake, Apache Spark, Gitlab, Git, Data Lakes, Pyspark, Jenkins, Amazon Redshift, Databricks - **Published:** September 23, 2026 - **Apply:** https://www.hellowork.com/fr-fr/emplois/83634402.html ## About the Role Formation / Expérience Diplômé d'une école d'ingénieurs ou titulaire d'un Master (Bac +5) Minimum 4 ans d'expérience (hors alternance)Compétences techniques Maîtrise de PySpark (optimisation, UDFs, DataFrames).Expérience confirmée avec Databricks (Delta Lake, Spark SQL, clusters).Pratique avancée de DBT (modélisation, tests, documentation).Connaissance des bases de données (SQL, NoSQL) et des entrepôts cloud (Snowflake, BigQuery, Redshift).Familiarité avec les outils de versioning (Git) et les environnements DevOps.Qualités personnelles Capacité à travailler en équipe pluridisciplinaire.Rigueur, autonomie et sens de l'innovation.Excellente communication technique et fonctionnelle.Langues et mobilité Maîtrise professionnelle de l'anglais, * Diplômé d'une école d'ingénieurs ou titulaire d'un Master (Bac +5) * Minimum 4 ans d'expérience (hors alternance) Compétences techniques * Maîtrise de PySpark (optimisation, UDFs, DataFrames). * Expérience confirmée avec Databricks (Delta Lake, Spark SQL, clusters). * Pratique avancée de DBT (modélisation, tests, documentation). * Connaissance des bases de données (SQL, NoSQL) et des entrepôts cloud (Snowflake, BigQuery, Redshift). * Familiarité avec les outils de versioning (Git) et les environnements DevOps. Qualités personnelles * Capacité à travailler en équipe pluridisciplinaire. * Rigueur, autonomie et sens de l'innovation. * Excellente communication technique et fonctionnelle. Langues et mobilité * Maîtrise professionnelle de l'anglais EUR Cluster Prometheus Anglais ETL Google cloud platform SQL Modélisation des données Git Jenkins Autonomie NoSQL Logiciels de gestion de versions ## Description Concevoir et déployer des pipelines de données robustes et scalables à l'aide de Databricks, PySpark et DBT, pour alimenter des environnements d'analyse et de machine learning. - Optimiser les performances des traitements ETL/ELT en exploitant les bonnes pratiques de data modeling (schémas en étoile, en flocon, etc.) et les capacités distribuées de Spark. - Collaborer avec les Data Scientists et les équipes métiers pour comprendre les besoins et livrer des jeux de données fiables, documentés et prêts à l'emploi. - Automatiser le déploiement et la maintenance des pipelines via des outils CI/CD (GitLab, Jenkins, etc.) et garantir leur monitoring (Airflow, Prometheus, etc.). - Contribuer à l'évolution de l'architecture data du groupe, en intégrant des solutions cloud (AWS, Azure ou GCP) et en veillant à la conformité RGPD et aux normes de sécurité. - Intervenir en tant qu'expert technique pour résoudre les problèmes complexes liés à la qualité, la latence ou la volumétrie des données. - Documenter les processus, les schémas de données et les bonnes pratiques pour faciliter la maintenance et l'onboarding des nouveaux membres de l'équipe. ## Related Videos - [How a Small Team Shrank a Microsoft Monorepo by 94%](https://www.wearedevelopers.com/videos/1236-how-a-small-team-shrank-a-microsoft-monorepo-by-94) - [Leveraging Real time data in FSIs](https://www.wearedevelopers.com/videos/806-leveraging-real-time-data-in-fsis) - [From DevOps to Scaled DevOps: How We’re Rebuilding Continuous Delivery as a Platform](https://www.wearedevelopers.com/videos/100018-from-devops-to-scaled-devops-how-we-re-rebuilding-continuous-delivery-as-a-platform) - [From Messy Queries to Scalable Systems - How Data Engineering actually works](https://www.wearedevelopers.com/videos/100203-from-messy-queries-to-scalable-systems-how-data-engineering-actually-works) - [Git for Code Reviews](https://www.wearedevelopers.com/videos/429-git-for-code-reviews) - [Empowering Retail Through Applied Machine Learning](https://www.wearedevelopers.com/videos/976-empowering-retail-through-applied-machine-learning) ## Related Articles - [Data Engineer Salary UK](https://www.wearedevelopers.com/magazine/253-data-engineer-salary-uk) - [Data Analyst Salary in the UK](https://www.wearedevelopers.com/magazine/278-data-analyst-salary-in-the-uk) - [Software Engineer Salary London](https://www.wearedevelopers.com/magazine/252-software-engineer-salary-london) - [Top-Paying Tech Jobs (with Salaries)](https://www.wearedevelopers.com/magazine/372-top-paying-tech-jobs-with-salaries) - [The Most Popular IT Jobs on the Market](https://www.wearedevelopers.com/magazine/376-the-most-popular-it-jobs-on-the-market) - [Fullstack Developer Salary UK](https://www.wearedevelopers.com/magazine/251-fullstack-developer-salary-uk)