Data Engineer GCP / PySpark / dbt (H/F)

DATAMED RESEARCH
Montigny-le-Bretonneux, France
19 days ago
Apply on candidat.francetravail.fr
Prepare application

Role details

Contract type
Permanent contract
Employment type
Full-time (> 32 hours)
Experience level
Experienced
Experience required
3 years minimum
Working hours
Regular working hours

Tech stack

Data Analysis Pyspark

Job description

  • Analyser les données d’une étude, d’un projet
  • Concevoir et gérer un projet

Requirements

Savoir-être professionnels

  • Avoir l’esprit d’équipe
  • Faire preuve de rigueur et de précision
  • Etre ouvert aux changements

Benefits & conditions

  • Primes
  • Indemnité transports
  • Titres restaurant / Prime de panier
  • Ordinateur portable
  • tout dépend du profil et de l’expérience

Déplacements Déplacements : Jamais Zone départementale

About the company

Contexte de la mission : Dans le cadre du développement et de l’évolution d’une plateforme Data Cloud, nous recherchons un Data Engineer GCP pour intervenir sur la conception, le développement et l’industrialisation de pipelines de données à grande échelle. Missions principales : Concevoir, développer et maintenir des pipelines de données batch et/ou streaming. Développer les traitements de données avec Python / PySpark et SQL. Réaliser les transformations et la modélisation des données avec dbt. Exploiter les services GCP : BigQuery, Dataproc, Cloud Storage, Pub/Sub, Composer/Airflow. Optimiser les traitements Spark et les performances des requêtes BigQuery. Industrialiser et automatiser les déploiements via les processus CI/CD. Mettre en place les contrôles de qualité, fiabilité et monitoring des données. Participer à la conception et à l’évolution de l’architecture Data. Collaborer avec les Data Analysts, Data Scientists et équipes métiers. Compétences recherchées : GCP, PySpark, Python, SQL, dbt, BigQuery, Dataproc, Cloud Storage, Airflow/Composer, Git et CI/CD. Profil recherché : Data Engineer confirmé disposant d’une expérience significative sur des environnements GCP et Big Data, avec une très bonne maîtrise de PySpark, SQL et dbt. Le consultant devra être autonome, à l’aise sur des problématiques d’industrialisation et capable d’intervenir sur des volumes de données importants.

Apply for this position

This job is hosted externally. Click below to view the full posting and apply.

Apply on candidat.francetravail.fr
Prepare application

Good distractions

Talks and stories from around this role — technically off-topic, practically not.

3:09 min

Balancing data science skillings alongside systems engineering rigor

Nico Schmidt · LIVE

1:48 min

Automating exploratory data analysis within training pipelines

Dora Petrella · World Congress 2023

4:32 min

Harnessing Spark with Python using PySpark and Py4J

Ayon Roy · LIVE

3:37 min

Scaling machine learning pipelines from prototypes to petabytes

Julian Joseph · LIVE

1:34 min

Bringing diverse skills to industrial data science roles

Katja Träumner

1:36 min

Performing exploratory data analysis to uncover underlying patterns

Julian Joseph · LIVE

Videos

See all

Related articles

See all