Data Engineer Databricks & DBT en CDI (H/F)

PREREQUIS
Paris, France
about 1 month ago

Role details

Contract type
Permanent contract
Employment type
Full-time (> 32 hours)
Working hours
Regular working hours
Job source

Tech stack

Amazon Web Services Microsoft Azure Cloud Computing Data Warehousing SQL Databases Google Cloud Delivery Pipeline Data Build Tool (dbt) Apache Spark Git Data Lakes Pyspark
+2 more
Data Lakehouse Databricks

Job description

Vous rejoindrez une équipe Data dynamique afin de concevoir, développer et optimiser des pipelines de données robustes, scalables et performants, en vous appuyant sur Databricks, dbt et les meilleures pratiques d’ingénierie Data.

Vos missionsConcevoir, développer et maintenir des pipelines de données fiables et performants.

Développer des transformations de données avec dbt.

Concevoir et optimiser des traitements de données sur Databricks (Spark/PySpark).

Participer à la modélisation des données (Data Warehouse, Data Lakehouse).

Mettre en ?uvre les bonnes pratiques de qualité, de tests et de documentation.

Industrialiser les traitements via des pipelines CI/CD.

Collaborer avec les équipes Data Analysts, Data Scientists et métiers.

Participer à l’amélioration continue de la plateforme Data.

Requirements

Profil candidat:Compétences techniquesIndispensables : Excellente maîtrise de Databricks.

Très bonne connaissance de dbt (Data Build Tool).

Maîtrise de SQL.

Expérience en PySpark et Spark.

Connaissance des architectures Data Lake / Lakehouse.

Expérience des plateformes Cloud (Azure, AWS ou GCP).

Maîtrise de Git.

About the company

Nous recherchons pour l’un de nos clients un Data Engineer Databricks & DBT en CDI (H/F)

Apply for this position

This job is hosted externally. Click below to view the full posting and apply.

Apply on fr.indeed.com

Good distractions

Talks and stories from around this role — technically off-topic, practically not.

6:21 min

Investigating push inefficiencies with upstream Git experts

Jonathan Creamer · Coffee With Developers

4:32 min

Harnessing Spark with Python using PySpark and Py4J

Ayon Roy · LIVE

3:24 min

The governance failures of centralized data lakes

Mario Meir-Huber · LIVE

4:59 min

Bringing DevOps practices to data transformation with DBT

Matthias Niehoff Matthias Niehoff · WWC 2024

56 sec

Favorite git commands and the importance of patch commits

Eileen Uchitelle Eileen Uchitelle +1 · Coffee With Developers

3:09 min

Balancing data science skillings alongside systems engineering rigor

Nico Schmidt · LIVE

Videos

See all

Related articles

See all