Data Engineer Databricks Junior H/F

Cabinet De Spécialisé Data
Boulogne-Billancourt, France
1 day ago
Apply on www.hellowork.com
Prepare application

Role details

Contract type
Permanent contract
Employment type
Full-time (> 32 hours)
Experience level
Starter
Experience required
2 years minimum
Compensation
€50,000.0 - €55,000.0
Working hours
Regular working hours

Tech stack

Amazon Web Services Microsoft Azure Cloud Computing Software Quality Extract Transform Load (ETL) Python (Programming Language) SQL Databases Data Streaming Management of Software Versions Planning Software Google Cloud Git
+4 more
Data Lakes Pyspark Data Management Databricks

Job description

Dans le cadre d’un besoin urgent, nous recherchons un(e) Data Engineer pour intervenir directement chez l’un des clients finaux du cabinet (acteur majeur de son secteur).

À noter : Il s’agit d’un environnement final particulièrement stimulant mais très exigeant. Vous y intégrerez une équipe de haut niveau où la rigueur, l’autonomie et la qualité du code sont primordiales.

Vos responsabilités principales seront les suivantes :

  • Développement & Ingénierie : Concevoir, développer et maintenir des pipelines de données (ETL/ELT) scalables et robustes au sein de l’environnement Databricks.
  • Traitement de la donnée : Manipuler et transformer de larges volumes de données structurées et non structurées.
  • Qualité & Performance : Assurer la fiabilité, les tests, l’industrialisation et l’optimisation des flux de données existants.
  • Interface avec les équipes : Comprendre les enjeux métiers, échanger de manière fluide avec les différentes équipes tech, et remonter les alertes ou propositions d’amélioration de façon proactive.

Requirements

Profil recherchéProfil RecherchéVous justifiez d’une expérience de 2 à 3 ans sur des fonctions de Data Engineer sur databricks. Vous recherchez un environnement challengeant pour monter en compétences rapidement et vous frotter à des problématiques data complexes.Compétences Techniques (Hard Skills)Stack Cible : Pratique concrète et opérationnelle de Databricks indispensable.Langages : Maîtrise de Python (PySpark) et SQL avancé.Cloud : Bonne connaissance d’au moins un environnement Cloud public (Azure, AWS ou GCP). Note : une affinité avec l’écosystème Azure est un vrai plus.Bonnes pratiques : Connaissance des concepts d’architecture Data (Datalake, Lakehouse) et des principes de versioning/CI-CD (Git).Savoir-être (Soft Skills) - Critères DécisifsRigueur absolue : Le niveau d’exigence nécessite une grande fiabilité dans les livrables et le respect strict des best practices.Résilience et Adaptabilité : Capacité à évoluer dans un contexte dynamique, urgent et sous pression.Communication : Excellente posture de consultant, capacité à s’exprimer clairement et à justifier ses choix techniques avec pertinence., Vous justifiez d’une expérience de 2 à 3 ans sur des fonctions de Data Engineer sur databricks. Vous recherchez un environnement challengeant pour monter en compétences rapidement et vous frotter à des problématiques data complexes.

Compétences Techniques (Hard Skills)

  • Stack Cible : Pratique concrète et opérationnelle de Databricks indispensable.
  • Langages : Maîtrise de Python (PySpark) et SQL avancé.
  • Cloud : Bonne connaissance d’au moins un environnement Cloud public (Azure, AWS ou GCP). Note : une affinité avec l’écosystème Azure est un vrai plus.
  • Bonnes pratiques : Connaissance des concepts d’architecture Data (Datalake, Lakehouse) et des principes de versioning/CI-CD (Git).

Savoir-être (Soft Skills) - Critères Décisifs

  • Rigueur absolue : Le niveau d’exigence nécessite une grande fiabilité dans les livrables et le respect strict des best practices.
  • Résilience et Adaptabilité : Capacité à évoluer dans un contexte dynamique, urgent et sous pression.
  • Communication : Excellente posture de consultant, capacité à s’exprimer clairement et à justifier ses choix techniques avec pertinence.

EUR

ETL Google cloud platform SQL AWS Gestion des données Git Python Autonomie Logiciels de gestion de versions

About the company

Entreprise : Cabinet de conseil spécialisé Data, Notre client est un cabinet de conseil à taille humaine, reconnu pour son expertise pointue dans la Data et le Pilotage de la Performance. L’approche n’est pas seulement technique : il s’agit d’accompagner la transformation des données en leviers de décision concrets.

En rejoignant leur pôle Data, vous intégrez une structure dynamique où l’excellence technique côtoie la proximité humaine (40 personnes), avec la forte opportunité d’évoluer au contact d’experts de référence sur le marché.

Apply for this position

This job is hosted externally. Click below to view the full posting and apply.

Apply on www.hellowork.com
Prepare application

Good distractions

Talks and stories from around this role — technically off-topic, practically not.

6:21 min

Investigating push inefficiencies with upstream Git experts

Jonathan Creamer · Coffee With Developers

4:32 min

Harnessing Spark with Python using PySpark and Py4J

Ayon Roy · LIVE

3:24 min

The governance failures of centralized data lakes

Mario Meir-Huber · LIVE

3:09 min

Balancing data science skillings alongside systems engineering rigor

Nico Schmidt · LIVE

56 sec

Favorite git commands and the importance of patch commits

Eileen Uchitelle Eileen Uchitelle +1 · Coffee With Developers

1:34 min

Bringing diverse skills to industrial data science roles

Katja Träumner

Videos

See all

Related articles

See all