> Markdown version of [/jobs/ext/2858418-dev-data-engineer-datalake-ip-h-f](https://www.wearedevelopers.com/jobs/ext/2858418-dev-data-engineer-datalake-ip-h-f). Every page supports `.md` or `Accept: text/markdown`. Links point to the HTML versions so they work for humans too. Agent guide: [/agents.md](https://www.wearedevelopers.com/agents.md). --- # Dev - Data Engineer Datalake IP H/F - **Company:** Nexton - **Location:** Paris, France - **Experience:** Experienced - **Contract:** Permanent contract - **Skills:** Artificial Intelligence, Big Data, Continuous Integration, Apache Hadoop, Hadoop Distributed File System, Apache Hive, Python (Programming Language), SQL Databases, Parquet, Informatica Powercenter, Delivery Pipeline, Apache Spark, Technical Debt, Git, Data Lakes, Pyspark, Bitbucket, Jenkins, Control M - **Published:** September 12, 2026 - **Apply:** https://www.hellowork.com/fr-fr/emplois/83312355.html ## About the Role Tu justifies de 3 à 6 ans d'expérience sur :Python 3, Spark / PySpark, SQL / HQLLes architectures Big Data distribuées On-Premise (Hadoop, HDFS, Parquet, Iceberg, Hive, Starburst)Le développement, l'industrialisation et la migration de pipelines de données complexes (ex: migration Informatica vers Python/Spark)Et tu as :De solides compétences en automatisation, orchestration de production (Control-M) et CI/CD (Jenkins, Git, XLDeploy/XLRelease)Une capacité à proposer des architectures simples, fiables et sécurisées à des problématiques Data complexesUne vraie aisance dans l'utilisation au quotidien des outils d'IA pour optimiser et accélérer tes développementsUn excellent relationnel, de la rigueur et une bonne écoute des besoins métier (projets CASH & Trade), * De solides compétences en automatisation, orchestration de production (Control-M) et CI/CD (Jenkins, Git, XLDeploy/XLRelease) * Une capacité à proposer des architectures simples, fiables et sécurisées à des problématiques Data complexes * Une vraie aisance dans l'utilisation au quotidien des outils d'IA pour optimiser et accélérer tes développements * Un excellent relationnel, de la rigueur et une bonne écoute des besoins métier (projets CASH & Trade), Intelligence artificielle Hadoop SQL Git Sens du relationnel Hive Jenkins Big data Python Control-M ## Description Tu intègres l'équipe en tant que Dev/Data engineer pour l'un de nos clients grands comptes du secteur bancaire.Tu participeras directement aux développements et à la gestion de la plateforme DataLake (GTLake) pour accompagner les projets stratégiques CASH et Trade, dans un contexte fort d'industrialisation et de modernisation applicative., Concevoir, développer et industrialiser de nouveaux pipelines de données DataLake sous Spark/PySpark - Piloter la phase de mutation et de migration des workflows Informatica DEI vers une architecture moderne en code Python/PySpark - Assurer la gestion de la production au quotidien, le suivi des batchs (Control-M) et le traitement de la dette technique - Revoir l'architecture actuelle du GTLake et proposer des évolutions structurantes pour la plateforme - Mettre en oeuvre le stockage et l'interrogation de données à forte échelle (HDFS, Parquet, Iceberg, Hive/HQL, Starburst) - Traduire les exigences des projets CASH et Trade en architectures data fiables, robustes et sécurisées - Travailler en étroite collaboration avec les Product Owners, les chefs de projet, les experts data et les équipes SI - Automatiser les déploiements et intégrations via les pipelines CI/CD (Jenkins, Bitbucket, XLDeploy/XLRelease) et exploiter les outils d'IA pour accélérer les développements - Contribuer à l'amélioration continue des processus et à la documentation technique de la Squad, * Les architectures Big Data distribuées On-Premise (Hadoop, HDFS, Parquet, Iceberg, Hive, Starburst) * Le développement, l'industrialisation et la migration de pipelines de données complexes (ex: migration Informatica vers Python/Spark) ## Related Videos - [Parquet, Delta, Iceberg & Ducklake - An introduction for developers](https://www.wearedevelopers.com/videos/100075-parquet-delta-iceberg-ducklake-an-introduction-for-developers) - [How a Small Team Shrank a Microsoft Monorepo by 94%](https://www.wearedevelopers.com/videos/1236-how-a-small-team-shrank-a-microsoft-monorepo-by-94) - [The Road to MLOps: How Verivox Transitioned to AWS](https://www.wearedevelopers.com/videos/1050-the-road-to-mlops-how-verivox-transitioned-to-aws) - [Alibaba Big Data and Machine Learning Technology](https://www.wearedevelopers.com/videos/37-alibaba-big-data-and-machine-learning-technology) - [Enjoying SQL data pipelines with dbt](https://www.wearedevelopers.com/videos/823-enjoying-sql-data-pipelines-with-dbt) - [Git for Code Reviews](https://www.wearedevelopers.com/videos/429-git-for-code-reviews) ## Related Articles - [Top Big Data Technologies That You Need to Know](https://www.wearedevelopers.com/magazine/108-top-big-data-technologies-that-you-need-to-know) - [Best Companies to Work For in Paris: Top 25 Companies in 2023 ](https://www.wearedevelopers.com/magazine/190-best-companies-to-work-for-in-paris-top-25-companies-in-2023) - [Highest Paying Tech Companies for Developers](https://www.wearedevelopers.com/magazine/220-highest-paying-tech-companies-for-developers) - [The Most Popular IT Jobs on the Market](https://www.wearedevelopers.com/magazine/376-the-most-popular-it-jobs-on-the-market) - [Data Engineer Salary UK](https://www.wearedevelopers.com/magazine/253-data-engineer-salary-uk) - [Top-Paying Tech Jobs (with Salaries)](https://www.wearedevelopers.com/magazine/372-top-paying-tech-jobs-with-salaries)