Incidents publiés
Lecture de l'historique en cours…
Ce que contient un incident
Chaque incident publié porte : un titre, les composants touchés, un impact (dégradé, partiel ou majeur), une origine (OncoIDE, ou un fournisseur nommé), un début et une fin, l'impact visible pour les utilisateurs, la cause, la résolution et, le cas échéant, un post-mortem.
Il suit quatre statuts : Investigation → Problème identifié → Surveillance → Résolu. Chaque mise à jour est horodatée et publiée dans la chronologie de l'incident.
Un incident publié ne peut pas masquer une panne mesurée : sur la page de statut, l'état affiché d'un composant est le pire des deux.
Le post-mortem
Un post-mortem reprend la chronologie de l'incident, sa durée, les composants touchés, la cause, la résolution et les actions décidées pour qu'il ne se reproduise pas.
Il est publié pour tout incident majeur, sous cinq jours ouvrés. Il apparaît alors dans l'incident concerné, sur cette page.
Communication de crise
Quand un incident est confirmé, la communication suit cet ordre :
- l'incident est ouvert et publié dès la confirmation, au statut « Investigation », avec ce que l'on sait des services touchés et depuis quand ;
- une mise à jour est publiée à chaque changement, et au moins toutes les deux heures ouvrées tant que l'incident est ouvert ;
- l'incident passe à « Résolu », avec l'heure de fin ;
- pour un incident majeur, le post-mortem est publié sous cinq jours ouvrés.
Le contrat de licence prévoit une information de l'établissement tous les deux jours ouvrés pour une anomalie empêchant l'accès : la page de statut ne remplace pas cette information directe.
Planifié L'abonnement aux incidents par courriel n'existe pas encore. En attendant, le flux Atom des incidents et maintenances peut être suivi dans un lecteur de flux ou par un outil de supervision.