Data Engineer Hadoop / PySpark - Plateforme Data (H/F)

Clostera
Paris, France
26 days ago
Apply on www.indeed.com
Prepare application

Role details

Contract type
Permanent contract
Employment type
Full-time (> 32 hours)
Experience level
Expert
Experience required
3 years minimum
Working hours
Regular working hours
Languages
English
Job source

Tech stack

Application Programming Interfaces (APIs) Agile Methodology Data Analysis JIRA Big Data BigQuery Cloud Computing Databases Continuous Integration Data Transformation DevOps Apache Hadoop
+10 more
Apache Hive Python (Programming Language) Scrum Methodology Shell Script SQL Databases Scripting Git Pyspark Jenkins Alteryx

Job description

Nous recherchons un(e) Data Engineer Hadoop / PySpark pour intervenir sur une plateforme Data stratégique et contribuer aux évolutions d?un datalake.

Vous serez en charge de la mise en ?uvre technique de nouvelles ingestions de données, des traitements de préparation et de transformation, ainsi que de la maintenance et de l?évolution des pipelines de données.

Vous travaillerez en étroite collaboration avec les équipes de production applicative et DevOps, dans un environnement Agile, dynamique et international.

Ce que vous ferez : Mettre en ?uvre de nouvelles ingestions de données au sein du datalake.

Développer les traitements de préparation et de transformation des données.

Maintenir et faire évoluer les pipelines de données en PySpark et shell scripting.

Développer et optimiser les traitements de données sur la plateforme Hadoop.

Exploiter Hive et SQL pour la manipulation, la transformation et l?analyse des données.

Collaborer avec l?équipe DevOps et lui adresser les demandes relatives aux évolutions de la plateforme.

Participer à l?intégration et au déploiement des évolutions via les outils de gestion de code source et d?intégration continue.

Rédiger des spécifications techniques claires et précises.

Analyser et résoudre des problématiques techniques complexes liées aux traitements et pipelines de données.

Contribuer à l?amélioration continue de la plateforme et être force de proposition sur les solutions et technologies à mettre en ?uvre.

Votre positionnement vous permettra d?intervenir au c?ur d?une plateforme Data stratégique, en interaction avec des équipes techniques multidisciplinaires et internationales.

Requirements

Formation : Bac+5 en informatique, Data Engineering, systèmes d?information ou équivalent.

Expérience : 3 à 6 ans d?expérience, avec une expérience significative en Data Engineering sur des environnements Hadoop et PySpark.

Compétences et expertises techniques : Big Data : Excellente maîtrise de la plateforme Hadoop et de Hive.

Développement Data : Excellente maîtrise de Python et PySpark.

Bases de données et requêtage : Bonne maîtrise de SQL.

Systèmes et scripting : Shell scripting sous Unix/Linux.

CI/CD et gestion de code : Git et Jenkins.

Outils projet : Jira.

Méthodologies : Expérience des environnements Agile, notamment SCRUM.

Data & Cloud - un plus : connaissances d?Indexima, Alteryx, Altair, GCP / BigQuery et de bibliothèques Python orientées API.

Soft skills : Autonomie, esprit d?initiative, forte capacité d?analyse, dynamisme, curiosité technique, excellent relationnel, capacité à travailler en équipe et force de proposition.

Niveau d?anglais : Professionnel à l?écrit comme à l?oral, indispensable pour les échanges réguliers avec une partie de l?équipe IT basée au Portugal.

Un plus : Expérience sur des environnements Data complexes et évolutifs, ainsi qu?une pratique de technologies complémentaires telles qu?Indexima, Alteryx, Altair ou GCP / BigQuery.

Apply for this position

This job is hosted externally. Click below to view the full posting and apply.

Apply on www.indeed.com
Prepare application

Good distractions

Talks and stories from around this role — technically off-topic, practically not.

3:09 min

Balancing data science skillings alongside systems engineering rigor

Nico Schmidt · LIVE

6:21 min

Investigating push inefficiencies with upstream Git experts

Jonathan Creamer · Coffee With Developers

3:05 min

Integrating an assistant application with Jira software

Felix Augenstein · LIVE

1:22 min

Analyzing differences between mobile and traditional backend DevOps

Mete Baydar Mete Baydar · World Congress 2025

3:03 min

Career evolution in data engineering and AI platforms

Maria Apazoglou · Coffee With Developers

56 sec

Favorite git commands and the importance of patch commits

Eileen Uchitelle Eileen Uchitelle +1 · Coffee With Developers

Videos

See all

Related articles

See all