Data Engineer H/F

Ma Boussole Aidants
Paris, France
3 months ago

Role details

Contract type
Permanent contract
Employment type
Full-time (> 32 hours)
Experience level
Experienced
Experience required
3 years minimum
Compensation
€45,000.0 - €55,000.0
Working hours
Regular working hours
Job source

Tech stack

Microsoft Excel Application Programming Interfaces (APIs) Airflow Amazon Web Services Microsoft Azure Databases Data Infrastructure JSON Python (Programming Language) Open Data Protocol SQL Databases Data Streaming
+11 more
Extensible Markup Language (XML) Parquet Simple Object Database Access Google Cloud Azure Data Factory Apache Spark Data Lakes Pyspark AWS Data Analytics Apache Kafka Data Lakehouse

Job description

Rejoindre Ma Boussole Aidants, c’est contribuer Ă  une mission d’intĂ©rĂȘt gĂ©nĂ©ral au service des aidants en France., RattachĂ©(e) au Responsable Produit, en lien Ă©troit avec les Ă©quipes techniques et data, vous intervenez au sein d’une Ă©quipe pluridisciplinaire composĂ©e de Data Manager, Data Analysts et gestionnaires de donnĂ©es. Vous Ă©voluez dans un environnement en structuration, au cƓur des enjeux de fiabilisation, d’industrialisation et de valorisation de la donnĂ©e. Vous travaillez en Ă©troite collaboration avec les Ă©quipes Produit, Technique et DĂ©ploiement, dans une logique de construction progressive de notre Data Platform et d’amĂ©lioration continue de nos usages data.

Vos principales missions

  • Contribuer Ă  la fiabilisation d’une base de donnĂ©es territoriale Ă  fort enjeu d’usage (orientation des aidants)
  • IntĂ©grer et structurer des donnĂ©es issues de sources hĂ©tĂ©rogĂšnes (open data, partenaires, scraping, rĂ©fĂ©rentiels nationaux type FINESS, etc.)
  • Concevoir, dĂ©velopper et maintenir des pipelines de donnĂ©es robustes et scalables.
  • Mettre en place des architectures Data Lakehouse sur les plateformes cloud (AWS, GCP, Azure).
  • DĂ©velopper des transformations de donnĂ©es avec Spark, dbt et les outils modernes de la stack data.
  • Orchestrer les workflows de donnĂ©es avec Airflow, Dagster ou Prefect.
  • Garantir la qualitĂ©, la fiabilitĂ© et la traçabilitĂ© des donnĂ©es (data quality, lineage).
  • Participer Ă  la dĂ©finition des standards et bonnes pratiques data de l’équipe.
  • Optimiser les performances des traitements et les coĂ»ts d’infrastructure.
  • Collaborer avec les Data Analysts et DBA pour comprendre leurs besoins.

Les enjeux du poste

  • Structurer une Data Platform en forte croissance (volumĂ©trie, diversitĂ© des sources)
  • Industrialiser des flux
  • AmĂ©liorer la qualitĂ© et la fraĂźcheur de donnĂ©es critiques pour les parcours utilisateurs
  • PrĂ©parer l’exploitation avancĂ©e de la donnĂ©e, * IntĂ©gration et fiabilisation de donnĂ©es issues de sources externes (API, open data, fichiers mĂ©tiers).
  • Conception et maintenance de pipelines de traitement et de standardisation des donnĂ©es.
  • Consolidation et rapprochement de rĂ©fĂ©rentiels multi-sources.
  • Automatisation des contrĂŽles qualitĂ© et du suivi des anomalies de donnĂ©es.
  • Structuration et Ă©volution des modĂšles de donnĂ©es pour des usages opĂ©rationnels et analytiques.
  • Mise en place et amĂ©lioration des outils et pratiques data dans un environnement en structuration.
  • Optimisation des traitements et des flux de donnĂ©es dans un contexte cloud., * Un projet Ă  fort impact social, au croisement de la data et des politiques publiques
  • Une plateforme en construction, avec de vrais choix structurants Ă  faire
  • Une Ă©quipe Ă  taille humaine, en lien direct avec les dĂ©cideurs
  • Des sujets data variĂ©s : ingestion, qualitĂ©, structuration, diffusion, APIs

Requirements

  • DiplĂŽmĂ©(e) en informatique ou data engineering, vous disposez d’au moins 3 ans d’expĂ©rience en ingĂ©nierie des donnĂ©es.
  • ExpĂ©rience dans l’intĂ©gration, la standardisation et la fiabilisation de donnĂ©es externes (API, open data, fichiers CSV/Excel/JSON/XML, rĂ©fĂ©rentiels publics).
  • ExpĂ©rience avec la gestion et la consolidation de rĂ©fĂ©rentiels de donnĂ©es multi-sources.
  • Excellente maĂźtrise de Python et SQL pour le traitement de donnĂ©es.
  • ExpĂ©rience avec des frameworks de traitement de donnĂ©es en Python (pandas, PySpark, DuckDB ou Ă©quivalent
  • MaĂźtrise d’au moins un orchestrateur (Airflow, Dagster, Prefect).
  • Bonne connaissance d’au moins une plateforme cloud (AWS, GCP, Azure) et de ses services data.
  • CapacitĂ© Ă  Ă©voluer dans un environnement en structuration et Ă  faire Ă©voluer les pratiques
  • SensibilitĂ© aux enjeux produit et Ă  l’impact utilisateur de la donnĂ©e
  • Rigueur, autonomie et capacitĂ© Ă  prioriser dans un contexte agile

Apprécié

  • Certification cloud data (AWS Data Analytics, GCP Data Engineer, Azure Data Engineer).
  • ExpĂ©rience avec Kafka, Kinesis ou autres technologies de streaming.
  • Connaissance des outils de data quality (Great Expectations, Soda)
  • ExpĂ©rience avec les outils de transformation (dbt) et les formats modernes (Parquet, Delta Lake, Iceberg).

Types d’activitĂ©

Benefits & conditions

RĂ©munĂ©ration : 45 000,00€ Ă  55 000,00€ par an

Avantages :

  • RTT

Lieu du poste : Télétravail hybride (75017 Paris)

About the company

Chaque jour, des millions d’aidants font face Ă  des parcours complexes pour accĂ©der Ă  une information fiable et Ă  des solutions adaptĂ©es.

Ma Boussole Aidants a pour ambition d’ĂȘtre un tiers de confiance national de l’information et de l’orientation des aidants, en structurant une rĂ©ponse lisible, accessible et coordonnĂ©e Ă  l’échelle des territoires.

En tant que SociĂ©tĂ© CoopĂ©rative d’IntĂ©rĂȘt Collectif, nous dĂ©veloppons, aux cĂŽtĂ©s des acteurs publics, associatifs et privĂ©s, une infrastructure d’information d’intĂ©rĂȘt gĂ©nĂ©ral, au service des politiques publiques et des parcours d’information et d’orientation des aidants.

Notre Data Platform alimente aujourd’hui des services utilisĂ©s par des millions d’aidants et des partenaires publics et privĂ©s, notamment via notre annuaire de solutions, nos APIs et nos outils d’aide Ă  la dĂ©cision. Elle est au cƓur de notre capacitĂ© Ă  structurer, fiabiliser et diffuser une information territoriale complexe Ă  grande Ă©chelle.

Apply for this position

This job is hosted externally. Click below to view the full posting and apply.

Apply on indeed.com

Good distractions

Talks and stories from around this role — technically off-topic, practically not.

2:15 min

Empowering domain teams with an open data platform

Sandhya Menon Sandhya Menon · WWC Europe 2026

3:09 min

Balancing data science skillings alongside systems engineering rigor

Nico Schmidt · LIVE

4:32 min

Harnessing Spark with Python using PySpark and Py4J

Ayon Roy · LIVE

3:47 min

Exploring JSON, CBOR, and JOSE for data serialization

Aaron Russell · LIVE

3:37 min

Scaling machine learning pipelines from prototypes to petabytes

Julian Joseph · LIVE

3:05 min

Audience questions on AI agents and pipeline vectorization

Joy Joy · WWC 2024

Videos

See all

Related articles

See all