Reliability incident manager H/F
- Discuss this with your agent
- Open in Claude
- Open in ChatGPT
Prepare application
- Draft this with your agent
- Open in Claude
- Open in ChatGPT
Role details
Tech stack
Job description
La mission s?inscrit au sein de l?équipe Reliability Management (RMA), composée de 5 collaborateurs, qui coordonne la résolution des situations graves ou critiques afin de rétablir le service IT à un niveau de criticité acceptable dans les meilleurs délais.
Périmètre et organisation
L?équipe intervient sur 3 piliers : ? Prévention : exercices de tests IPSI / ILSI (tests de résilience / tests de restauration), surveillance, checks et validation des opérations sur la production des changements d?infrastructure et des releases applicatives ? Action de résolution : gestion de crise sur les incidents graves ou critiques avec coordination des équipes et reportings ? Plans de fiabilisation : réalisation de post-mortems à la suite des incidents et suivi des plans de fiabilisation jusqu?à leur clôture, Le prestataire aura pour responsabilités : ? Déclencher et animer les réunions de gestion d?incident en français ou en anglais ? Rédiger et publier des communications d?incident claires et synthétiques en temps réel ? Rédiger les post-mortems sur les incidents majeurs ? Rédiger les comptes rendus de réunions ? Contribuer à l?avancement des plans de fiabilisation issus des post-mortems ? Contribuer à la production de tableaux de bord, reportings et statistiques ? Représenter l?équipe RMA dans les réunions de suivi des revues d?incidents et des plans de fiabilisation ? Participer ou apporter un support à la préparation des tests IPSI / ILSI ? Participer ou animer les Change & Release Advisory Board ? Participer à la coordination de certaines opérations en production (tests IPSI / ILSI, tests après opérations majeures, etc.) ? Contribuer à l?amélioration continue du fonctionnement de l?équipe, ? Profil expérimenté à sénior
Suivi et livrables
? Animation des réunions de gestion d?incident ? Communications d?incident en direct ? Post-mortems sur incidents majeurs ? Comptes rendus de réunions ? Suivi des plans de fiabilisation ? Tableaux de bord / reporting / statistiques ? Participation aux tests de résilience et de restauration ? Participation aux instances Change & Release Advisory Board ? Rapport trimestriel d?activité établi dans l?outil de suivi d?activité et validé par les parties
Compétences / Qualités indispensables: Gestion d?incidents critiques,Gestion de problèmes,Animation en français et en anglais,Reporting et post-mortem,Coordination d?équipes IT,Jira / Confluence
Requirements
? ITSM Atlassian : Jira, Confluence, ? Compréhension du fonctionnement général de la plateforme ? Capacité d?animation et de rédaction en anglais et en français ? Expertise requise en gestion d?incidents et en gestion de problèmes
About the company
Notre client dans le secteur Banque et finance recherche un Reliability Manager - incident manager H/F Descriptif de la mission, Contexte et objectif de la mission
Dans le cadre du développement de ses systèmes de gestion, une entité technologique spécialisée dans les solutions pour l?épargne et la gestion d?actifs souhaite recourir à une prestation externe pour assister la gestion des incidents et des problèmes, afin de réduire les temps d?interruption de service et d?améliorer la fiabilité de la plateforme.
Apply for this position
This job is hosted externally. Click below to view the full posting and apply.
Prepare application
- Draft this with your agent
- Open in Claude
- Open in ChatGPT
Good distractions
Talks and stories from around this role — technically off-topic, practically not.
Moments
Explore playlistsVideos
See allRelated articles
See all
Best Companies to Work For in France: Top 25 Companies in 2023Â
The Geometry of Incidents: Connecting User Impact to Architecture
How We Built a Worry-Free System That Runs for 10+ Years – And What We’d Do Again
Guide for Expats Living in France