Support Engineering Lead - Data & ai Platforms H/F

Stellantis
Poissy, France
2 months ago

Role details

Contract type
Permanent contract
Employment type
Full-time (> 32 hours)
Experience level
Expert
Working hours
Regular working hours
Job source

Tech stack

Airflow Amazon Web Services JIRA Microsoft Azure Bash Shell Big Data Cloud Computing DevOps Python (Programming Language) Site Reliability Engineering Practices Google Cloud Delivery Pipeline
+8 more
Apache Spark Mttr Data Lakes Kubernetes Apache Kafka Data Management Pagerduty Servicenow

Job description

Le Responsable Support Engineering (IC) est un leader technique opĂ©rationnel chargĂ© d’assurer et d’exĂ©cuter le support de Niveau 1 (L1) pour les plateformes Big Data et IA d’entreprise. En plus de la gestion quotidienne des incidents et de leur rĂ©solution, ce rĂŽle consiste Ă  concevoir, standardiser et amĂ©liorer en continu les processus de support, les outils et les pratiques opĂ©rationnelles. Vous serez le rĂ©fĂ©rent technique du support L1, en collaboration Ă©troite avec les Ă©quipes d’ingĂ©nierie plateforme, SRE et produit, afin d’amĂ©liorer la fiabilitĂ© des plateformes, rĂ©duire la charge opĂ©rationnelle et offrir une expĂ©rience de support de haute qualitĂ© aux utilisateurs., ExĂ©cution et responsabilitĂ© du support L1

  • Agir comme premier rĂ©pondant L1 pour les incidents, alertes et demandes utilisateurs sur les plateformes Big Data et IA
  • RĂ©aliser la triage initial, l’évaluation d’impact et la priorisation
  • RĂ©soudre les problĂšmes connus ou courants via des runbooks, outils ou automatisations
  • Escalader les incidents complexes aux Ă©quipes L2/L3 en fournissant diagnostics, logs et contexte dĂ©taillĂ©s
  • Assurer le suivi, la traçabilitĂ© et la clĂŽture complĂšte des incidents Gestion des incidents

  • Piloter la rĂ©ponse aux incidents au niveau L1
  • Garantir une communication claire et rapide durant les incidents
  • Participer aux analyses post incident et revues de causes racines
  • Identifier les incidents rĂ©currents et proposer des actions prĂ©ventives

Gestion des processus & outils

  • Mettre en place et amĂ©liorer continuellement les processus de support L1, incluant o Flux d’entrĂ©e et triage o DĂ©finition des niveaux de sĂ©vĂ©ritĂ© o Chemins d’escalade et passages de relais o SLAs et attentes de rĂ©ponse

  • Concevoir, documenter et maintenir les runbooks, SOPs et bases de connaissances
  • DĂ©finir et mettre en oeuvre les outils de support tels que : o SystĂšmes de tickets et gestion d’incidents o IntĂ©grations d’alerting et monitoring o Tableaux de bord de visibilitĂ© opĂ©rationnelle

  • Automatiser les tĂąches rĂ©pĂ©titives pour rĂ©duire l’effort manuel et le MTTR

PérimÚtre technologique Assurer le support L1 pour :

  • Plateformes Big Data (ex : Spark, Kafka, Airflow, data lakes/warehouses)
  • Plateformes IA/ML (pipelines d’entraĂźnement, services d’infĂ©rence, runtimes GPU)
  • Runtimes Kubernetes et infrastructures cloud
  • Pipelines CI/CD et workflows data
  • Stacks d’observabilitĂ© (logs, mĂ©triques, traces)

Collaboration & influence

  • Travailler en Ă©troite collaboration avec les Ă©quipes d’ingĂ©nierie plateforme, SRE et produit pour : o AmĂ©liorer l’opĂ©rabilitĂ© et la maintenabilitĂ© des plateformes o Apporter du feedback issu de la production et des incidents utilisateurs o Influencer les roadmaps grĂące aux enseignements opĂ©rationnels

  • Être un point de contact de confiance pour les utilisateurs des plateformes
  • Accompagner et mentoriser les autres ingĂ©nieurs support

Requirements

DiplĂŽme Bac +5 en informatique, data engineering, data management ou domaine connexeCompĂ©tences techniques- Solide expĂ©rience pratique dans le support de plateformes Big Data et IA- Connaissance opĂ©rationnelle des environnements cloud (AWS, GCP, Azure)- ExpĂ©rience avec Kubernetes et les workloads containerisĂ©s- MaĂźtrise du diagnostic via logs, mĂ©triques et dashboards- CompĂ©tences en scripting ou automatisation (Python, Bash, etc.)CompĂ©tences opĂ©rationnelles & processus- ExpĂ©rience avĂ©rĂ©e dans l’établissement ou l’amĂ©lioration de processus de support- Solides compĂ©tences en gestion d’incidents et analyse de causes racines- CapacitĂ© Ă  Ă©quilibrer exĂ©cution opĂ©rationnelle et amĂ©lioration continue- Excellentes compĂ©tences de communication Ă©crite et oraleBonus : - ExpĂ©rience dans des Ă©quipes plateformes ou Internal Developer Platform- Connaissance des pratiques SRE, DevOps ou Production Engineering- ExpĂ©rience avec des outils de support (PagerDuty, Opsgenie, Jira, ServiceNow, etc.)- FamiliaritĂ© avec les concepts ITIL (sans lourdeur procĂ©durale), DiplĂŽme Bac +5 en informatique, data engineering, data management ou domaine connexe

Compétences techniques

  • Solide expĂ©rience pratique dans le support de plateformes Big Data et IA
  • Connaissance opĂ©rationnelle des environnements cloud (AWS, GCP, Azure)
  • ExpĂ©rience avec Kubernetes et les workloads containerisĂ©s
  • MaĂźtrise du diagnostic via logs, mĂ©triques et dashboards
  • CompĂ©tences en scripting ou automatisation (Python, Bash, etc.)

Compétences opérationnelles & processus

  • ExpĂ©rience avĂ©rĂ©e dans l’établissement ou l’amĂ©lioration de processus de support
  • Solides compĂ©tences en gestion d’incidents et analyse de causes racines
  • CapacitĂ© Ă  Ă©quilibrer exĂ©cution opĂ©rationnelle et amĂ©lioration continue
  • Excellentes compĂ©tences de communication Ă©crite et orale

Bonus :

  • ExpĂ©rience dans des Ă©quipes plateformes ou Internal Developer Platform
  • Connaissance des pratiques SRE, DevOps ou Production Engineering
  • ExpĂ©rience avec des outils de support (PagerDuty, Opsgenie, Jira, ServiceNow, etc.)
  • FamiliaritĂ© avec les concepts ITIL (sans lourdeur procĂ©durale)

Apply for this position

This job is hosted externally. Click below to view the full posting and apply.

Apply on hellowork.com

Good distractions

Talks and stories from around this role — technically off-topic, practically not.

3:09 min

Balancing data science skillings alongside systems engineering rigor

Nico Schmidt · LIVE

2:17 min

Mapping the maturity roadmap for scaled devops adoption

Dominik Krichbaum Dominik Krichbaum · World Congress 2026 Europe

3:08 min

Aligning engineering processes with core business impact metrics

Chris Riley · World Congress 2021

3:05 min

Integrating an assistant application with Jira software

Felix Augenstein · LIVE

3:18 min

Scaling global network engineering through DevOps culture

Stuart Clark · LIVE

3:07 min

Establishing service level agreements directly for internal platforms

Pawel Piwosz · LIVE

Videos

See all

Related articles

See all