Reliability incident manager H/F

LeHibou
Paris, France
3 months ago
Apply on indeed.com
Prepare application

Role details

Contract type
Permanent contract
Employment type
Full-time (> 32 hours)
Experience level
Expert
Working hours
Regular working hours
Languages
English, French
Job source

Tech stack

Confluence JIRA Microsoft Office Atlassian Tools

Job description

La mission s?inscrit au sein de l?équipe Reliability Management (RMA), composée de 5 collaborateurs, qui coordonne la résolution des situations graves ou critiques afin de rétablir le service IT à un niveau de criticité acceptable dans les meilleurs délais.

Périmètre et organisation

L?équipe intervient sur 3 piliers : ? Prévention : exercices de tests IPSI / ILSI (tests de résilience / tests de restauration), surveillance, checks et validation des opérations sur la production des changements d?infrastructure et des releases applicatives ? Action de résolution : gestion de crise sur les incidents graves ou critiques avec coordination des équipes et reportings ? Plans de fiabilisation : réalisation de post-mortems à la suite des incidents et suivi des plans de fiabilisation jusqu?à leur clôture, Le prestataire aura pour responsabilités : ? Déclencher et animer les réunions de gestion d?incident en français ou en anglais ? Rédiger et publier des communications d?incident claires et synthétiques en temps réel ? Rédiger les post-mortems sur les incidents majeurs ? Rédiger les comptes rendus de réunions ? Contribuer à l?avancement des plans de fiabilisation issus des post-mortems ? Contribuer à la production de tableaux de bord, reportings et statistiques ? Représenter l?équipe RMA dans les réunions de suivi des revues d?incidents et des plans de fiabilisation ? Participer ou apporter un support à la préparation des tests IPSI / ILSI ? Participer ou animer les Change & Release Advisory Board ? Participer à la coordination de certaines opérations en production (tests IPSI / ILSI, tests après opérations majeures, etc.) ? Contribuer à l?amélioration continue du fonctionnement de l?équipe, ? Profil expérimenté à sénior

Suivi et livrables

? Animation des réunions de gestion d?incident ? Communications d?incident en direct ? Post-mortems sur incidents majeurs ? Comptes rendus de réunions ? Suivi des plans de fiabilisation ? Tableaux de bord / reporting / statistiques ? Participation aux tests de résilience et de restauration ? Participation aux instances Change & Release Advisory Board ? Rapport trimestriel d?activité établi dans l?outil de suivi d?activité et validé par les parties

Compétences / Qualités indispensables: Gestion d?incidents critiques,Gestion de problèmes,Animation en français et en anglais,Reporting et post-mortem,Coordination d?équipes IT,Jira / Confluence

Requirements

? ITSM Atlassian : Jira, Confluence, ? Compréhension du fonctionnement général de la plateforme ? Capacité d?animation et de rédaction en anglais et en français ? Expertise requise en gestion d?incidents et en gestion de problèmes

About the company

Notre client dans le secteur Banque et finance recherche un Reliability Manager - incident manager H/F Descriptif de la mission, Contexte et objectif de la mission

Dans le cadre du développement de ses systèmes de gestion, une entité technologique spécialisée dans les solutions pour l?épargne et la gestion d?actifs souhaite recourir à une prestation externe pour assister la gestion des incidents et des problèmes, afin de réduire les temps d?interruption de service et d?améliorer la fiabilité de la plateforme.

Apply for this position

This job is hosted externally. Click below to view the full posting and apply.

Apply on indeed.com
Prepare application

Good distractions

Talks and stories from around this role — technically off-topic, practically not.

2:33 min

Expanding enterprise search integrations with Jira, Confluence, and GitHub

Prashanth Chandrasekar Prashanth Chandrasekar · World Congress 2024

3:05 min

Integrating an assistant application with Jira software

Felix Augenstein · LIVE

1:43 min

Core foundations for successful artificial intelligence transformation

Alexander Birke Alexander Birke +1 · World Congress 2024

8:02 min

Integrating service level objectives into incident management

Diana Todea · LIVE

5:15 min

Managing token consumption and knowledge base context

Simon A.T. Jiménez Simon A.T. Jiménez · Europe 2026 Virtual

3:02 min

Balancing tool consolidation and collaborative open source workflows

Nele Uhlemann · World Congress 2023

Videos

See all

Related articles

See all