Data Engineer Senior - Boulogne-Billancourt H/F

Cegedim
Boulogne-Billancourt, France
8 days ago
Apply on www.hellowork.com
Prepare application

Role details

Contract type
Permanent contract
Employment type
Part-time (≤ 32 hours)
Experience level
Expert
Experience required
5 years minimum
Working hours
Regular working hours

Tech stack

Query Performance Airflow Confluence JIRA Big Data Cloud Computing Code Review Databases Continuous Integration Data Infrastructure Extract Transform Load (ETL) Data Systems
+16 more
Data Warehousing Relational Databases Elasticsearch Python (Programming Language) Microsoft SQL Server SQL Databases SQLAlchemy TypeScript Data Processing Scripting Gitlab Git Containerization Kubernetes Vertica Docker

Job description

Vous rejoindrez une équipe d’ingénierie Data en pleine transformation, au coeur du passage vers des architectures modernes : Data Platform cloud-native, pipelines scalables., En tant que Data Engineer Senior, vous êtes un pilier technique de la Data Platform de GERS Data. Vos responsabilités couvrent l’ensemble du cycle de vie de la donnée :

  • Concevoir, développer et maintenir des pipelines de données robustes et scalables (ETL/ELT) depuis les sources LGO officinales jusqu’aux datamarts métier
  • Architecturer et optimiser les entrepôts de données (SQL Server, ClickHouse) : modélisation, partitionnement, indexation, performance des requêtes
  • Orchestrer les flux de traitement avec Apache Airflow : définition des DAGs, gestion des dépendances, monitoring et alerting
  • Contribuer à la qualité des données : implémenter des systèmes de détection d’anomalies, de scoring de fiabilité et de réconciliation sur les flux journaliers
  • Participer à la stratégie de migration et d’évolution de la plateforme data (Elasticsearch ClickHouse, SQL Server, cloud)
  • Collaborer étroitement avec les Product Managers et les équipes d’analyse pour traduire les besoins métier en solutions techniques
  • Contribuer à la culture d’ingénierie : revues de code, documentation, pair programming, mentorat des profils juniors, Un rôle clé dans la modernisation d’une Data Platform traitant des milliards de lignes de données pharmaceutiques
  • Un environnement technique exigeant et stimulant, avec une vraie autonomie
  • Une équipe R&D structurée (Développement, Data Engineering, Product, UX/UI)
  • La sécurité d’un grand groupe (Cegedim) avec l’agilité d’une équipe produit
  • Télétravail partiel, équipement de qualité, mutuelle, tickets restaurant, primes (intéressement, vacances).

Requirements

Bases de données : SQL Server, ClickHouse, Elasticsearch

  • Orchestration : Apache Airflow
  • Langages : Python, SQL, TypeScript/Node.js
  • Infra : Docker, Kubernetes, CI/CD GitLab
  • Outils : Git, Jira, Confluence, Vous êtes un ingénieur Data expérimenté, à l’aise aussi bien sur les aspects bas niveau (SQL, optimisation) que sur l’architecture globale des systèmes de données.De formation Bac +5 en Ecole d’ingénieur ou Master Big Data ou équivalentUne expérience de 5 ans minimum sur des missions de Data Engineering (sans compter des stages ou alternances)Compétences techniquesSQL avancé : optimisation de requêtes complexes, procédures stockées, tuning sur SQL Server et/ou ClickHousePython maîtrisé : développement de pipelines, scripting, manipulation de données (pandas, polars, sqlalchemy)Orchestration : Apache Airflow (DAGs, XComs, pools, connexions)Modélisation : expertise DWH et datamart (schémas étoile/flocon, conception de datamarts métier, gestion de l’historisation)Conteneurisation et CI/CD : Docker, Git, pipelines de déploiementNotions Kubernetes appréciées (déploiement, sizing, monitoring)Soft skillsRigueur et sens de la qualité de la donnéeAutonomie et capacité à prendre des décisions techniquesCuriosité et capacité d’adaptation dans un environnement en évolution rapideBon communicant, capable d’échanger avec des profils non techniques., Vous êtes un ingénieur Data expérimenté, à l’aise aussi bien sur les aspects bas niveau (SQL, optimisation) que sur l’architecture globale des systèmes de données.

  • De formation Bac +5 en Ecole d’ingénieur ou Master Big Data ou équivalent
  • Une expérience de 5 ans minimum sur des missions de Data Engineering (sans compter des stages ou alternances)

Compétences techniques

  • SQL avancé : optimisation de requêtes complexes, procédures stockées, tuning sur SQL Server et/ou ClickHouse
  • Python maîtrisé : développement de pipelines, scripting, manipulation de données (pandas, polars, sqlalchemy)
  • Orchestration : Apache Airflow (DAGs, XComs, pools, connexions)
  • Modélisation : expertise DWH et datamart (schémas étoile/flocon, conception de datamarts métier, gestion de l’historisation)
  • Conteneurisation et CI/CD : Docker, Git, pipelines de déploiement
  • Notions Kubernetes appréciées (déploiement, sizing, monitoring)

Soft skills

  • Rigueur et sens de la qualité de la donnée
  • Autonomie et capacité à prendre des décisions techniques
  • Curiosité et capacité d’adaptation dans un environnement en évolution rapide
  • Bon communicant, capable d’échanger avec des profils non techniques.

EUR

ETL SGBD SQL Git Kubernetes Python Autonomie Gestion de base de données Jira Capacité d’adaptation TypeScript Scripting Docker

About the company

Fondée en 1969, Cegedim est une entreprise innovante de technologies et de services spécialisée dans la gestion des flux numériques de l’écosystème santé et BtoB, ainsi que dans la conception de logiciels métier destinés aux professionnels de santé et de l’assurance. Cegedim compte plus de 6 700 collaborateurs dans plus de 10 pays et a réalisé un chiffre d’affaires de 654 millions d’euros en 2024.

GERS Data est la référence française des données pharmaceutiques, filiale du Groupe Cegedim. Nos plateformes alimentent les outils de pilotage commercial, les études épidémiologiques et les entrepôts de données de santé utilisés par les plus grands laboratoires français et européens., Fondée en 1969, Cegedim est une entreprise innovante de technologies et de services spécialisée dans la gestion des flux numériques de l’écosystème santé et BtoB, ainsi que dans la conception de logiciels métier destinés aux professionnels de santé et de l’assurance. Cegedim compte plus de 6 700 collaborateurs dans plus de 10 pays et a réalisé un chiffre d’affaires de 654 millions d’euros en 2024.GERS Data est la référence française des données pharmaceutiques, filiale du Groupe Cegedim. Nos plateformes alimentent les outils de pilotage commercial, les études épidémiologiques et les entrepôts de données de santé utilisés par les plus grands laboratoires français et européens.

Apply for this position

This job is hosted externally. Click below to view the full posting and apply.

Apply on www.hellowork.com
Prepare application

Good distractions

Talks and stories from around this role — technically off-topic, practically not.

3:09 min

Balancing data science skillings alongside systems engineering rigor

Nico Schmidt · LIVE

6:21 min

Investigating push inefficiencies with upstream Git experts

Jonathan Creamer · Coffee With Developers

3:05 min

Integrating an assistant application with Jira software

Felix Augenstein · LIVE

2:07 min

Inspecting default bridge architectures and custom Docker networks

Oliver Seitz Oliver Seitz · World Congress 2025

2:57 min

Core technical practices for robust data engineering

Sandhya Menon Sandhya Menon · World Congress 2026 Europe

56 sec

Favorite git commands and the importance of patch commits

Eileen Uchitelle Eileen Uchitelle +1 · Coffee With Developers

Videos

See all

Related articles

See all