Data Engineer Hadoop / PySpark - Plateforme Data (H/F)
- Discuss this with your agent
- Open in Claude
- Open in ChatGPT
Prepare application
- Draft this with your agent
- Open in Claude
- Open in ChatGPT
Role details
Tech stack
+10 more
Job description
Nous recherchons un(e) Data Engineer Hadoop / PySpark pour intervenir sur une plateforme Data stratégique et contribuer aux évolutions d?un datalake.
Vous serez en charge de la mise en ?uvre technique de nouvelles ingestions de données, des traitements de préparation et de transformation, ainsi que de la maintenance et de l?évolution des pipelines de données.
Vous travaillerez en étroite collaboration avec les équipes de production applicative et DevOps, dans un environnement Agile, dynamique et international.
Ce que vous ferez : Mettre en ?uvre de nouvelles ingestions de données au sein du datalake.
Développer les traitements de préparation et de transformation des données.
Maintenir et faire évoluer les pipelines de données en PySpark et shell scripting.
Développer et optimiser les traitements de données sur la plateforme Hadoop.
Exploiter Hive et SQL pour la manipulation, la transformation et l?analyse des données.
Collaborer avec l?équipe DevOps et lui adresser les demandes relatives aux évolutions de la plateforme.
Participer à l?intégration et au déploiement des évolutions via les outils de gestion de code source et d?intégration continue.
Rédiger des spécifications techniques claires et précises.
Analyser et résoudre des problématiques techniques complexes liées aux traitements et pipelines de données.
Contribuer à l?amélioration continue de la plateforme et être force de proposition sur les solutions et technologies à mettre en ?uvre.
Votre positionnement vous permettra d?intervenir au c?ur d?une plateforme Data stratégique, en interaction avec des équipes techniques multidisciplinaires et internationales.
Requirements
Formation : Bac+5 en informatique, Data Engineering, systèmes d?information ou équivalent.
Expérience : 3 à 6 ans d?expérience, avec une expérience significative en Data Engineering sur des environnements Hadoop et PySpark.
Compétences et expertises techniques : Big Data : Excellente maîtrise de la plateforme Hadoop et de Hive.
Développement Data : Excellente maîtrise de Python et PySpark.
Bases de données et requêtage : Bonne maîtrise de SQL.
Systèmes et scripting : Shell scripting sous Unix/Linux.
CI/CD et gestion de code : Git et Jenkins.
Outils projet : Jira.
Méthodologies : Expérience des environnements Agile, notamment SCRUM.
Data & Cloud - un plus : connaissances d?Indexima, Alteryx, Altair, GCP / BigQuery et de bibliothèques Python orientées API.
Soft skills : Autonomie, esprit d?initiative, forte capacité d?analyse, dynamisme, curiosité technique, excellent relationnel, capacité à travailler en équipe et force de proposition.
Niveau d?anglais : Professionnel à l?écrit comme à l?oral, indispensable pour les échanges réguliers avec une partie de l?équipe IT basée au Portugal.
Un plus : Expérience sur des environnements Data complexes et évolutifs, ainsi qu?une pratique de technologies complémentaires telles qu?Indexima, Alteryx, Altair ou GCP / BigQuery.
Apply for this position
This job is hosted externally. Click below to view the full posting and apply.
Prepare application
- Draft this with your agent
- Open in Claude
- Open in ChatGPT
Good distractions
Talks and stories from around this role — technically off-topic, practically not.
Moments
Explore playlistsVideos
See allRelated articles
See all
Best Companies to Work For in Paris: Top 25 Companies in 2023Â
Where To Find Software Engineering Jobs
Data Analyst Salary in the UK
Top Big Data Technologies That You Need to Know