En tant qu'Incident & Problem Manager, vous êtes chargé de la gestion de bout en bout des incidents et de la résolution structurelle des problèmes sous-jacents afin d'améliorer en permanence la stabilité des services informatiques. Vous alliez une coordination opérationnelle rapide lors de perturbations à une analyse approfondie et à l'amélioration des processus à moyen terme.
Incident Management
Gestion opérationnelle
- Vous gérez l'ensemble du cycle de vie des incidents : enregistrement, priorisation, suivi et clôture.
- Vous garantissez la bonne application des processus ITIL en matière de gestion des incidents.
- Vous surveillez le respect des SLA et remontez rapidement les informations aux équipes concernées ainsi qu'au management.
- Vous faites office de "single point of contact" pour les incidents à fort impact (P1/P2).
Major Incident Management
- Vous activez et dirigez la Major Incident Team en cas de perturbations graves.
- Vous coordonnez les experts, les fournisseurs et les équipes concernées jusqu'à ce que la situation soit rétablie.
- Vous assurez une communication claire et en temps utile à destination du management et des utilisateurs finaux.
- Vous documentez les incidents majeurs et initiez des améliorations structurelles.
Communication & reporting
- Vous informez les parties prenantes en toute transparence du statut, de l'impact et du délai de résolution escompté.
- Vous fournissez des rapports hebdomadaires et mensuels sur les incidents.
Problem Management
Analyse des problèmes
- Vous identifiez les problèmes structurels sur la base des tendances en matière d'incidents, du monitoring et de l'input des équipes IT.
- Vous réalisez des analyses des causes racines (par exemple : fishbone, 5 Why’s of fault tree analysis).
- Vous documentez les problèmes, leurs causes sous-jacentes et les solutions possibles.
Prévention & amélioration continue
- Vous mettez en place des mesures correctives et préventives (CAPA).
- Vous suivez la mise en œuvre des solutions avec les équipes agiles et les fournisseurs.
- Vous veillez à ce que les leçons tirées soient intégrées dans les backlogs de l'équipe.
- Vous animez les Post-Incident Reviews et les Problem Review Meetings.
- Vous collaborez avec des experts pour configurer la plateforme d'observabilité Dynatrace afin que les incidents et les problèmes puissent être traités plus efficacement.
Coordination avec le Change & Release Management
- Vous collaborez avec le Change Manager pour mettre en ...