Data Engineer H/F
- Discuss this with your agent
- Open in Claude
- Open in ChatGPT
Role details
Tech stack
+11 more
Job description
Rejoindre Ma Boussole Aidants, câest contribuer Ă une mission dâintĂ©rĂȘt gĂ©nĂ©ral au service des aidants en France., RattachĂ©(e) au Responsable Produit, en lien Ă©troit avec les Ă©quipes techniques et data, vous intervenez au sein dâune Ă©quipe pluridisciplinaire composĂ©e de Data Manager, Data Analysts et gestionnaires de donnĂ©es. Vous Ă©voluez dans un environnement en structuration, au cĆur des enjeux de fiabilisation, dâindustrialisation et de valorisation de la donnĂ©e. Vous travaillez en Ă©troite collaboration avec les Ă©quipes Produit, Technique et DĂ©ploiement, dans une logique de construction progressive de notre Data Platform et dâamĂ©lioration continue de nos usages data.
Vos principales missions
- Contribuer Ă la fiabilisation dâune base de donnĂ©es territoriale Ă fort enjeu dâusage (orientation des aidants)
- Intégrer et structurer des données issues de sources hétérogÚnes (open data, partenaires, scraping, référentiels nationaux type FINESS, etc.)
- Concevoir, développer et maintenir des pipelines de données robustes et scalables.
- Mettre en place des architectures Data Lakehouse sur les plateformes cloud (AWS, GCP, Azure).
- Développer des transformations de données avec Spark, dbt et les outils modernes de la stack data.
- Orchestrer les workflows de données avec Airflow, Dagster ou Prefect.
- Garantir la qualité, la fiabilité et la traçabilité des données (data quality, lineage).
- Participer Ă la dĂ©finition des standards et bonnes pratiques data de lâĂ©quipe.
- Optimiser les performances des traitements et les coĂ»ts dâinfrastructure.
- Collaborer avec les Data Analysts et DBA pour comprendre leurs besoins.
Les enjeux du poste
- Structurer une Data Platform en forte croissance (volumétrie, diversité des sources)
- Industrialiser des flux
- Améliorer la qualité et la fraßcheur de données critiques pour les parcours utilisateurs
- PrĂ©parer lâexploitation avancĂ©e de la donnĂ©e, * IntĂ©gration et fiabilisation de donnĂ©es issues de sources externes (API, open data, fichiers mĂ©tiers).
- Conception et maintenance de pipelines de traitement et de standardisation des données.
- Consolidation et rapprochement de référentiels multi-sources.
- Automatisation des contrÎles qualité et du suivi des anomalies de données.
- Structuration et évolution des modÚles de données pour des usages opérationnels et analytiques.
- Mise en place et amélioration des outils et pratiques data dans un environnement en structuration.
- Optimisation des traitements et des flux de données dans un contexte cloud., * Un projet à fort impact social, au croisement de la data et des politiques publiques
- Une plateforme en construction, avec de vrais choix structurants Ă faire
- Une équipe à taille humaine, en lien direct avec les décideurs
- Des sujets data variés : ingestion, qualité, structuration, diffusion, APIs
Requirements
- DiplĂŽmĂ©(e) en informatique ou data engineering, vous disposez dâau moins 3 ans dâexpĂ©rience en ingĂ©nierie des donnĂ©es.
- ExpĂ©rience dans lâintĂ©gration, la standardisation et la fiabilisation de donnĂ©es externes (API, open data, fichiers CSV/Excel/JSON/XML, rĂ©fĂ©rentiels publics).
- Expérience avec la gestion et la consolidation de référentiels de données multi-sources.
- Excellente maßtrise de Python et SQL pour le traitement de données.
- Expérience avec des frameworks de traitement de données en Python (pandas, PySpark, DuckDB ou équivalent
- MaĂźtrise dâau moins un orchestrateur (Airflow, Dagster, Prefect).
- Bonne connaissance dâau moins une plateforme cloud (AWS, GCP, Azure) et de ses services data.
- Capacité à évoluer dans un environnement en structuration et à faire évoluer les pratiques
- SensibilitĂ© aux enjeux produit et Ă lâimpact utilisateur de la donnĂ©e
- Rigueur, autonomie et capacité à prioriser dans un contexte agile
Apprécié
- Certification cloud data (AWS Data Analytics, GCP Data Engineer, Azure Data Engineer).
- Expérience avec Kafka, Kinesis ou autres technologies de streaming.
- Connaissance des outils de data quality (Great Expectations, Soda)
- Expérience avec les outils de transformation (dbt) et les formats modernes (Parquet, Delta Lake, Iceberg).
Types dâactivitĂ©
Benefits & conditions
Rémunération : 45 000,00⏠à 55 000,00⏠par an
Avantages :
- RTT
Lieu du poste : Télétravail hybride (75017 Paris)
About the company
Chaque jour, des millions dâaidants font face Ă des parcours complexes pour accĂ©der Ă une information fiable et Ă des solutions adaptĂ©es.
Ma Boussole Aidants a pour ambition dâĂȘtre un tiers de confiance national de lâinformation et de lâorientation des aidants, en structurant une rĂ©ponse lisible, accessible et coordonnĂ©e Ă lâĂ©chelle des territoires.
En tant que SociĂ©tĂ© CoopĂ©rative dâIntĂ©rĂȘt Collectif, nous dĂ©veloppons, aux cĂŽtĂ©s des acteurs publics, associatifs et privĂ©s, une infrastructure dâinformation dâintĂ©rĂȘt gĂ©nĂ©ral, au service des politiques publiques et des parcours dâinformation et dâorientation des aidants.
Notre Data Platform alimente aujourdâhui des services utilisĂ©s par des millions dâaidants et des partenaires publics et privĂ©s, notamment via notre annuaire de solutions, nos APIs et nos outils dâaide Ă la dĂ©cision. Elle est au cĆur de notre capacitĂ© Ă structurer, fiabiliser et diffuser une information territoriale complexe Ă grande Ă©chelle.
Apply for this position
This job is hosted externally. Click below to view the full posting and apply.
Apply on indeed.comGood distractions
Talks and stories from around this role â technically off-topic, practically not.
Moments
Explore playlistsVideos
See allRelated articles
See all
Best Companies to Work For in Paris: Top 25 Companies in 2023Â
Fully Remote Software Engineer Jobs
Data Analyst Salary in the UK
Software Engineer Salary London