Développeur Data - IA H/F

Exiptel
Saint-Denis, France
24 days ago
Apply on www.hellowork.com
Prepare application

Role details

Contract type
Permanent contract
Employment type
Full-time (> 32 hours)
Experience level
Experienced
Experience required
3 years minimum
Working hours
Regular working hours

Tech stack

Airflow Microsoft Azure Big Data Code Coverage Code Review Continuous Integration JSON Python (Programming Language) Ansible SQL Databases Virtual Machines Azure Data Factory
+8 more
Apache Spark Git Pyspark Gitlab-ci Terraform Code Restructuring Jenkins Databricks

Job description

Pour une mission longue pour un grand groupe, nous recherchons plusieurs développeur Data

  • Gestion JSON - traitement des json complexes avec multiples imbrications variables
  • Gestion de format Delta (similaire JSON) sous Databricks
  • Python / SQL / Databricks / Spark

  • Développement et déploiement de Jobs Spark (PySpark et Scala) en CI/CD sur Azure Databricks

  • Optimisation des chaines de traitements Big Data en termes de temps d’exécution et de couts des machines virtuelles (Cloud Azure)

  • Migration de l’architecture des données vers une architecture médaillon (Bronze, Silver, Gold)

  • Création de jobs de mise en qualité de la donnée (couche silver) : nettoyage, dédoublonnage, masquage de la donnée

  • Migration code contenu dans JARs (Spark Scala) vers code en PySpark sur notebooks, compatible avec Unity Catalog

  • Automatisation des déploiements et des livrables (Gitlab-Ci, Ansible, Jenkins)

  • Migration de l’écosystème Databricks existant vers Unity Catalog

  • Migration de parquet et orc à delta

  • Passage progressivement à une lecture de table au lieu d’une lecture directe des fichiers du datalake

  • Création d’une couche « silver » servant de couche de mise en qualité des données « bronze » avant

consommation dans des tables gold à valeur métier

  • Orchestration de jobs Spark sur Databricks Workflows

  • Modélisation et conception de nouvelles chaines de traitement, en collaboration avec les équipes métier (architecture

data)

  • Refactoring global de l’application et augmentation de la couverture de test du code (de 30% à 90%)

  • Revues de code et mise en place de contrôles techniques et automatisés de la qualité de la donnée (via Notebooks

Requirements

Profil recherché3 - 10 ans d’experienceTechnologies : Azure Databricks, Spark (Scala et PySpark), Jenkins, Airflow, Ecosysteme Databricks (Databricks Workflows, DeltaLake), Azure (Azure Data Factory, AKV, Adls, BlobStorage), GitLab CI, SQL, Terraform, Technologies : Azure Databricks, Spark (Scala et PySpark), Jenkins, Airflow, Ecosysteme Databricks (Databricks Workflows, DeltaLake), Azure (Azure Data Factory, AKV, Adls, BlobStorage), GitLab CI, SQL, Terraform

EUR

Ansible Unity Préparation des surfaces Scala SQL Git Jenkins Python Terraform JSON

Benefits & conditions

Taux journalier :Salaire selon profil

Apply for this position

This job is hosted externally. Click below to view the full posting and apply.

Apply on www.hellowork.com
Prepare application

Good distractions

Talks and stories from around this role — technically off-topic, practically not.

2:15 min

Empowering domain teams with an open data platform

Sandhya Menon Sandhya Menon · World Congress 2026 Europe

6:21 min

Investigating push inefficiencies with upstream Git experts

Jonathan Creamer · Coffee With Developers

3:47 min

Exploring JSON, CBOR, and JOSE for data serialization

Aaron Russell · LIVE

1:20 min

Identifying multi-disciplinary talent for developer experience engineering roles

Hazal Mestci +1 · Coffee With Developers

3:05 min

Audience questions on AI agents and pipeline vectorization

Joy Joy · World Congress 2024

2:03 min

Distinguishing type definition constructs from data validation routines

Clemens Vasters Clemens Vasters · World Congress 2025

Videos

See all

Related articles

See all