Data Engineer Pyspark/Azure

DATAMED RESEARCH
Nantes, France
3 months ago

Role details

Contract type
Permanent contract
Employment type
Full-time (> 32 hours)
Experience level
Experienced
Experience required
3 years minimum
Working hours
Regular working hours
Languages
English
Job source

Tech stack

Application Programming Interfaces (APIs) Confluence JIRA Microsoft Azure Relational Databases Python (Programming Language) Machine Learning Power BI SQL Databases Data Processing Git Pyspark
+1 more
Databricks

Job description

ContexteTransformer des données sources complexes en données exploitables pour les métiers, dans le respect des standards et de la stratégie data de SNCF Gares & Connexions.

Missions principalesComprendre les enjeux métier et les besoins data

Modéliser les données

Développer et optimiser les traitements en Python / SQL / PySpark

Industrialiser, superviser et documenter les traitements

Collaborer avec les équipes métier et techniques

Être force de proposition

Contribuer à l?évolution et à l?optimisation de la plateforme data

Travailler dans un cadre agile

Requirements

Compétences indispensablesPython et PySpark ? 5 ans minimum

Méthodes de Data Science / Machine Learning

SGBD et SQL ? 5 ans minimum

Gestion et manipulation de données dans une architecture data complexe ? 3 ans minimum

Git

RequĂȘtage d?API

Power BI et DAX ? 5 ans minimum

Compétences souhaitablesAzure

DataGalaxy

JIRA / Confluence

Anglais écrit et oral

Databricks

Connaissance de SNCF et/ou SNCF Gares & Connexions

Expériences indispensablesTravail en agilité ? 3 ans minimum

Développement de projets data ? 5 ans minimum

Manipulation de données en environnement data complexe et industriel ? 3 ans minimum

Expérience en BI

Expériences souhaitablesAzure

JIRA / Confluence

Anglais écrit et oral

Solide expérience Databricks

Apply for this position

This job is hosted externally. Click below to view the full posting and apply.

Apply on indeed.com

Good distractions

Talks and stories from around this role — technically off-topic, practically not.

6:21 min

Investigating push inefficiencies with upstream Git experts

Jonathan Creamer · Coffee With Developers

3:05 min

Integrating an assistant application with Jira software

Felix Augenstein · LIVE

4:32 min

Harnessing Spark with Python using PySpark and Py4J

Ayon Roy · LIVE

1:34 min

Bringing diverse skills to industrial data science roles

Katja TrÀumner

56 sec

Favorite git commands and the importance of patch commits

Eileen Uchitelle Eileen Uchitelle +1 · Coffee With Developers

3:09 min

Balancing data science skillings alongside systems engineering rigor

Nico Schmidt · LIVE

Videos

See all

Related articles

See all