Niveaux de gravité des incidents : une matrice d’escalade

·3 min de lecture

La gravité décrit l’impact métier actuel ou crédible, pas le ton d’un message de journal.

Deux tours de serveurs reliées par un chemin interrompu et une voie de reprise continue.

La gravité décrit l’impact métier actuel ou crédible, pas le ton d’un message de journal. Une matrice commune mobilise les bonnes personnes et évite de traiter chaque défaut comme une urgence. Utilisez des exemples du produit et autorisez une révision selon les preuves.

Évaluer plusieurs dimensions

Considérez clients, parcours critiques, conséquences financières ou de données, durée et contournement. Peu de clients peuvent justifier une forte urgence si leurs écritures sont corrompues. Un écran interne bruyant ne justifie pas forcément de réveiller toute l’équipe. Documentez l’incertitude et répondez prudemment lorsqu’une conséquence grave reste plausible.

Relier les niveaux aux actions

Le niveau le plus élevé peut couvrir un parcours vital arrêté ou un risque sérieux pour l’intégrité. Un niveau intermédiaire peut décrire une dégradation importante avec contournement limité. Ce sont des exemples, pas une norme universelle. Ajoutez notification, autorité et obligations contractuelles. Séparez impact, priorité et délai de réponse promis.

Améliorer après l’événement

Désignez coordination, technique et communication pour les incidents majeurs. Précisez qui peut reclasser et comment joindre les remplaçants. Comparez estimation initiale et impact final. Des désaccords répétés révèlent des exemples manquants. Ajouter des niveaux n’aide que s’ils produisent des réponses distinctes et si la matrice reste accessible pendant une panne.

Un exemple à vérifier

Une recherche indisponible et une modification de solde incorrecte peuvent toucher autant de clients tout en exigeant des réactions différentes. Faites classer les deux exemples par support, produit et technique avec justification. Vérifiez que la matrice déclenche réellement les bonnes responsabilités. Des conclusions différentes malgré les mêmes faits signalent des critères manquants. L’exercice doit aussi montrer comment communiquer une reclassification sans perdre les décisions déjà prises.

Questions fréquentes

SEV1 est-il toujours le plus grave ?

Les conventions varient ; publiez votre ordre explicitement.

La gravité peut-elle changer ?

Oui, avec motif et information des personnes concernées.

Toute alerte sécurité est-elle maximale ?

Évaluez crédibilité et impact possible selon le processus de sécurité.

Le nombre de clients suffit-il ?

Non. Intégrité, argent et fonctions critiques peuvent peser davantage.

Où conserver la matrice ?

Dans un emplacement accessible en incident, lié aux alertes et procédures.

Transformons votre besoin en périmètre réalisable

Partagez le parcours utilisateur, les intégrations et les contraintes de lancement. Nous pouvons préparer une estimation avec hypothèses et exclusions.

Pour aller plus loin

Retour arrière ou correctif urgent en production ?

Pendant un incident, choisissez l’action la plus susceptible de rétablir le service avec un risque contrôlé.

Reprise après sinistre : tester RTO et RPO

Un plan de reprise devient crédible lorsqu’un service utilisable peut être restauré.

Un runbook de production utilisable par une petite équipe

Un runbook aide à passer d’un symptôme précis à une décision sûre.