Senior Data Platform Manager - F/H

Atos
Tours, France
7 days ago

Role details

Contract type
Permanent contract
Employment type
Full-time (> 32 hours)
Experience level
Expert
Experience required
3 years minimum
Working hours
Regular working hours
Languages
French
Job source

Tech stack

Java (Programming Language) Application Programming Interfaces (APIs) Data Analysis User Authentication Batch Processing BigQuery Ubuntu (Operating System) Command-Line Interface COBOL (Programming Language) Databases Continuous Integration Data Infrastructure
+24 more
Extract Transform Load (ETL) Data Mining Relational Databases Linux Human-Computer Interaction IDoc Python (Programming Language) PostgreSQL Online Analytical Processing Open Source Technology Role-Based Access Control Salesforce.Com SAP (Applications) Single Sign-On SUSE Linux Enterprise Servers SQLAlchemy Okta Snowflake Backend Fastapi Vertica Restful APIs Streamlit Framework Docker

Job description

  • HPCCAT - le catalogue produit des matériels HPC, IA et quantique (~2 100 composants actifs, ~590 k commandes, 5,2 M lignes de devis)
  • Tableaux de bord de direction - indicateurs du programme GATE, prévisions S&OP et vues de feuille de route
  • Intégrations machine à machine - API REST utilisées par CQFD (chiffrage), HPC Designer (jumeau numérique) et des outils externes

Vous rejoindrez une petite équipe de trois personnes à fort impact et serez responsable de la couche data engineering : pipelines d’ingestion, modèles de transformation, qualité des données et infrastructure d’entrepôt.

Stack technique :

  • Base de données : PostgreSQL 16
  • Moteur analytique : DuckDB (OLAP, orienté colonnes)
  • Transformations : dbt-core + dbt-duckdb + dbt-postgres
  • API backend : FastAPI (Python 3.11+)
  • ORM : SQLAlchemy 2.x
  • Authentification : Keycloak (SSO, RBAC)
  • Conteneurs : Docker Compose v2
  • Migrations : Alembic
  • Interface utilisateur : Streamlit 1.50 (pages d’administration)
  • Gestion de versions : Git / GitHub Enterprise
  • Systèmes d’exploitation : Linux (SLES en production, Ubuntu en développement)

Responsabilités principales

  • Concevoir et maintenir des pipelines ETL/ELT pour ingérer les données de SAP, Salesforce, flux fournisseurs et bases internes

  • Concevoir et implémenter des modèles de transformation dbt (staging, intermédiaire, marts) sur PostgreSQL et DuckDB

  • Garantir la qualité des données : tests, supervision, détection d’anomalies et rapprochement avec les systèmes sources

  • Développer et faire évoluer l’API REST (FastAPI/Python) pour les applications consommatrices

  • Administrer l’infrastructure : Docker Compose, PostgreSQL 16, migrations Alembic et CI/CD

  • Collaborer avec les Product Managers pour comprendre les besoins en données et les traduire en modèles fiables

  • Documenter les modèles de données, la traçabilité et les procédures d’exploitation, * Travail visible : vos pipelines alimentent des tableaux de bord de direction et des intégrations interéquipes

  • Flexibilité hybride : jusqu’à trois jours de télétravail par semaine

  • Perspectives d’évolution : des rôles seniors et spécialisations apparaîtront avec la croissance de l’équipe

  • Expertise métier : HPC, IA et quantique, un marché à forte croissance (objectif de croissance organique de 20 % en 2026)

Processus de recrutement

  • Premier entretien avec notre Talent Acquisition Business Partner
  • Entretien technique
  • Entretien manager
  • Validation RH

Requirements

  • Au moins 3 ans d’expérience comme Data Engineer, Analytics Engineer ou Backend Engineer avec une forte orientation données

  • Maîtrise de SQL : requêtes complexes, fonctions de fenêtrage, CTE et optimisation de requêtes

  • Maîtrise de Python : code de qualité production, au-delà de simples scripts

  • Expérience des bases de données relationnelles (PostgreSQL de préférence)

  • Conception de pipelines ETL/ELT : traitement par lots et/ou en flux, gestion des erreurs et idempotence

  • Docker : maîtrise de la construction et de l’administration d’applications conteneurisées

  • Linux : aisance en ligne de commande et capacité à diagnostiquer les problèmes serveur

  • Autonomie : capacité à investiguer et résoudre des problèmes de manière indépendante

Atouts supplémentaires :

  • Expérience avec dbt (quel que soit l’adaptateur)
  • Expérience avec DuckDB ou d’autres moteurs analytiques (ClickHouse, Snowflake, BigQuery)
  • FastAPI et conception d’API REST
  • Alembic ou outils de migration de bases de données
  • Extraction de données SAP (IDocs, BAPIs, RFC ou exports de fichiers)
  • Mise en oeuvre de Keycloak, SSO ou RBAC
  • Expérience dans des environnements industriels, de production ou de données produit
  • Français courant, langue de travail de l’équipe et des interlocuteurs

Pourquoi postuler

  • Forte autonomie : contribution directe aux décisions d’architecture dès l’arrivée

  • Stack moderne : solutions open source, sans héritage Java/COBOL, Ici, vos idées, votre curiosité et votre excellence technique contribuent directement à façonner la prochaine ère du calcul avancé - en créant de la valeur pour les entreprises, en accélérant le progrès scientifique et en générant un impact positif pour la société.

Benefits & conditions

  • Télétravail : Flexibilité hybride (jusqu’à trois jours par semaine)
  • Localisation : Angers Échirolles (Grenoble) Les Clayes-sous-Bois (Paris)

About the company

A propos de Bull

Bull c’est une histoire. Un siècle d’innovation Européenne et un environnement de travail où des experts conçoivent des solutions numériques puissantes, durables et souveraines, permettant aux États et aux industries de garder la pleine maîtrise de leurs données et de leur IA.

Bull c’est aussi des milliers d’ingénieurs, de chercheurs, de passionnés de tech, façonnant l’avenir du calcul de haute performance, de l’IA et des technologies quantiques.

Chaque jour, nos équipes repoussent les limites du possible - des architectures HPC de nouvelle génération aux supercalculateurs exascale - soutenues par une R&D de rang mondial, plus de 1 600 brevets et des capacités de bout en bout uniques, couvrant la conception matérielle, l’ingénierie logicielle, la data science et la recherche quantique.

Centrés sur l’humain et portés par l’innovation, où la collaboration s’étend à l’Europe, aux Amériques et à l’Inde, nous partageons cette même vision d’une innovation responsable et durable, avec un impact concret pour nos clients., Nous construisons le Bull Enterprise Data Hub, une plateforme de données centralisée qui consolide les données produit de plus de huit systèmes sources (SAP, Salesforce, CQFD, PLM, flux fournisseurs) au sein d’une plateforme unifiée, versionnée et centrée sur les API.

Apply for this position

This job is hosted externally. Click below to view the full posting and apply.

Apply on fr.indeed.com

Good distractions

Talks and stories from around this role — technically off-topic, practically not.

3:09 min

Balancing data science skillings alongside systems engineering rigor

Nico Schmidt · LIVE

2:33 min

Introduction to security advocacy and automation testing

Chris Heilmann +2 · LIVE

52 sec

Running persistent Linux environments directly on Windows

Ben Breard Ben Breard · WWC 2025

4:37 min

Architecting single sign-on flows across multiple application domains

Gift Egwuenu · WWC 2023

2:39 min

Experiencing core Linux capabilities for DevOps administration

Michael Cade · LIVE

3:14 min

Structuring career paths and localized data architectures

Ulrich Wurstbauer +1 · LIVE

Videos

See all

Related articles

See all