Data Engineer Expert Python / Databricks / Spark - F/H

Ingéniance
Paris, France
28 days ago
Apply on fr.indeed.com
Prepare application

Role details

Contract type
Permanent contract
Employment type
Full-time (> 32 hours)
Experience level
Expert
Experience required
5 years minimum
Working hours
Regular working hours
Languages
English
Job source

Tech stack

Agile Methodology Airflow Amazon Web Services Unit Testing C Sharp (Programming Language) Extract Transform Load (ETL) Data Warehousing Python (Programming Language) Query Optimization Standard Sql SQL Databases Apache Spark
+2 more
Pyspark Databricks

Job description

Vous intégrez une équipe data dont la mission est d’industrialiser et de sécuriser les processus d’acquisition, de préparation et de qualification de données orientées prévision (forecasting) dans le domaine de l’énergie. Vos principales responsabilités :

  • Concevoir et développer des pipelines ETL robustes en Python et .NET/C# pour l’acquisition et la transformation de données structurées et non structurées
  • Garantir la qualité de la donnée : dédoublonnage, validation, standardisation, référencement
  • Créer et maintenir des DAGs Airflow pour orchestrer les dépendances entre traitements ETL
  • Exploiter la plateforme Databricks : exécution de jobs Spark, gestion des clusters, optimisation des requêtes SQL
  • Concevoir des schémas de données performants et optimiser les requêtes sur des entrepôts de données relationnels
  • Contribuer aux choix d’architecture et à la mise en place des bonnes pratiques data au sein de l’équipe
  • Rédiger les spécifications techniques et les tests unitaires associés
  • Assurer le monitoring en production et la maintenance des traitements déployés

Requirements

Formation Bac+5 en informatique, mathématiques appliquées ou équivalent. Expérience confirmée de 5 ans minimum en data engineering, avec une maîtrise experte de Python (v3) et une solide pratique de .NET/C#. Vous êtes à l’aise avec SQL et les data warehouses relationnels. Une expérience sur Databricks/PySpark et AWS est un vrai atout, de même qu’une pratique d’Airflow. La connaissance des séries temporelles et du forecasting sera appréciée. Vous êtes autonome, rigoureux, orienté qualité et capable de collaborer efficacement avec des équipes pluridisciplinaires (Data Analysts, Data Scientists, architectes). Niveau d’anglais professionnel indispensable (langue de travail de l’équipe). Méthodes Agile appréciées.

About the company

INGENIANCE est une ESN spécialisée en finance de marché, banque et assurance depuis plus de 18 ans. Nous accompagnons les grands acteurs bancaires et assurantiels français sur leurs projets les plus critiques, avec une expertise reconnue en Craft Development, Big Data, Cloud/DevOps et Agilité. Rejoindre Ingéniance, c’est intégrer une communauté d’experts, être accompagné par un management de proximité et construire son parcours sur des missions à forte valeur ajoutée. Build your success!

Apply for this position

This job is hosted externally. Click below to view the full posting and apply.

Apply on fr.indeed.com
Prepare application

Good distractions

Talks and stories from around this role — technically off-topic, practically not.

5:14 min

Executing Databricks jobs with built-in Airflow operators

Alan Mazankiewicz · LIVE

4:32 min

Harnessing Spark with Python using PySpark and Py4J

Ayon Roy · LIVE

2:19 min

Introduction to Apache Airflow for advanced orchestration

Alan Mazankiewicz · LIVE

3:09 min

Balancing data science skillings alongside systems engineering rigor

Nico Schmidt · LIVE

8:27 min

Building generic custom operators for Databricks APIs

Alan Mazankiewicz · LIVE

2:38 min

Overview of Databricks and interactive data processing

Alan Mazankiewicz · LIVE

Videos

See all

Related articles

See all