Senior Data Engineer H/F

Databricks & Pyspark
Paris, France
21 days ago
Apply on www.hellowork.com
Prepare application

Role details

Contract type
Permanent contract
Employment type
Full-time (> 32 hours)
Experience level
Expert
Working hours
Regular working hours

Tech stack

Airflow Amazon Web Services Cloud Computing Data Governance Data Warehousing Apache Spark Pyspark AWS Glue Databricks

Job description

Okara cherche un·e Senior Data Engineer

L’enjeu : Garantir la robustesse, l’évolution et l’adoption de la plateforme Data au coeur de l’écosystème d’un géant mondial du retail.

En tant que consultant·e Okara, tu rejoins l’équipe Managed Tools au sein de la Data Factory de notre client. Ton terrain de jeu ? La squad Compute, responsable de fournir la stack Data (calcul, orchestration, exposition), d’en assurer la scalabilité à l’échelle globale et d’acculturer des centaines d’utilisateurs aux meilleures pratiques.

Ton rôle

Tu n’es pas seulement là pour faire tourner de la tuyauterie : tu es à la fois l’architecte du moteur Data et l’évangéliste qui accompagne les équipes dans leur montée en puissance.

Concrètement, tu vas :

Piloter les Migrations Majeures : Relever des défis d’architecture critiques, notamment la migration d’AWS Glue Catalog vers Databricks Unity Catalog et de MWAA vers Astronomer (Airflow).

Master la Performance Compute : Optimiser les traitements PySpark sur Databricks, monitorer la plateforme et agir de manière proactive pour garantir une stabilité à toute épreuve.

Propager les Bonnes Pratiques : Définir les standards de Data Engineering (Spark, Databricks, orchestration) et former/accompagner les équipes métiers sur la plateforme.

Construire la Stack de Demain : Expérimenter de nouvelles fonctionnalités/outils et travailler sur les enjeux clés d’accessibilité et de gouvernance de la donnée.

Requirements

Expertise Databricks & PySpark : Tu as une expérience avancée et éprouvée sur Databricks (idéalement avec Unity Catalog) et tu maîtrises l’optimisation Spark à grande échelle.Orchestration & Cloud : Tu es très à l’aise avec Airflow (Astronomer), l’écosystème AWS (Glue, MWAA) et la Modern Data Stack.Mindset Platform & Enablement : Tu aimes faire monter les autres en compétences. Tu sais vulgariser des sujets complexes d’infrastructure et fédérer autour des bonnes pratiques software/data.Proactivité & Rigueur : Tu sais anticiper les goulots d’étranglement et garantir le maintien en condition opérationnelle d’une plateforme stratégique.

Mais aussi…

Le terrain de jeuÉchelle Massive : Ta plateforme héberge et orchestre les use cases Data de milliers d’utilisateurs et de dizaines d’équipes.Stack de Pointe : Databricks (Unity Catalog), PySpark, Astronomer (Airflow), AWS.Localisation Flexible : Poste basé à Lille ou Paris.Mindset Okara : Autonomie, partage de connaissances, excellence technique et impact direct sur la transformation Data du retail.Prêt·e à bâtir et opérer le moteur Data de demain ? Rejoins l’aventure Okara., Expertise Databricks & PySpark : Tu as une expérience avancée et éprouvée sur Databricks (idéalement avec Unity Catalog) et tu maîtrises l’optimisation Spark à grande échelle.

Orchestration & Cloud : Tu es très à l’aise avec Airflow (Astronomer), l’écosystème AWS (Glue, MWAA) et la Modern Data Stack.

Mindset Platform & Enablement : Tu aimes faire monter les autres en compétences. Tu sais vulgariser des sujets complexes d’infrastructure et fédérer autour des bonnes pratiques software/data.

Proactivité & Rigueur : Tu sais anticiper les goulots d’étranglement et garantir le maintien en condition opérationnelle d’une plateforme stratégique.

EUR

Unity AWS Pro-activité Gouvernance des données

Apply for this position

This job is hosted externally. Click below to view the full posting and apply.

Apply on www.hellowork.com
Prepare application

Good distractions

Talks and stories from around this role — technically off-topic, practically not.

2:15 min

Empowering domain teams with an open data platform

Sandhya Menon Sandhya Menon · World Congress 2026 Europe

55 sec

Validating data processing architectures via containerized events

Modood Alvi · World Congress 2025

4:32 min

Harnessing Spark with Python using PySpark and Py4J

Ayon Roy · LIVE

3:09 min

Balancing data science skillings alongside systems engineering rigor

Nico Schmidt · LIVE

3:37 min

Scaling machine learning pipelines from prototypes to petabytes

Julian Joseph · LIVE

3:05 min

Audience questions on AI agents and pipeline vectorization

Joy Joy · World Congress 2024

Videos

See all

Related articles

See all