【Suite avancée CJ 12/30 · 40e article au total】

Les notifications qui n’arrêtent pas de surgir à l’écran ne rendent pas le système plus sûr. À force d’en recevoir, on finit par apprendre à les ignorer.

Une alerte efficace doit au moins préciser quatre choses : quel élément pose problème, à quel point les données sont récentes, quelle trajectoire de risque est concernée et qui doit faire quoi ensuite. Si elle se contente d’indiquer « anomalie de spread » ou « anomalie d’interface », la personne qui la lit doit reprendre les vérifications depuis le début : le travail de surveillance est alors de nouveau confié à un humain.

Les alertes doivent aussi avoir différents niveaux de priorité. Une légère fluctuation qui peut se résorber automatiquement, un état incertain nécessitant une vérification humaine et un risque qui exige un gel immédiat ne peuvent pas être signalés de la même façon. Sinon, les signaux vraiment importants seront noyés dans le bruit ordinaire.

La disparition d’une alerte ne signifie pas non plus que le problème a été résolu. La notification doit consigner qui a pris le relais, quelles mesures ont été prises et sur quelle base le rétablissement a été confirmé. Renvoyer plusieurs fois le même message peut donner une impression d’activité, mais ne permet pas de compléter cette chaîne de responsabilité. Une alerte n’est utile que si elle permet de faire évoluer l’anomalie jusqu’à une conclusion claire.

L’objectif de la surveillance n’est pas de créer de l’inquiétude, mais de réduire le délai entre l’apparition d’une anomalie et la prise de la bonne mesure. Quelques alertes bien ciblées et exploitables sont généralement plus utiles qu’un écran entier de chiffres rouges à l’allure très professionnelle.

Prochain article : l’annulation automatique des ordres ne signifie pas que le risque est écarté ; les preuves doivent tout de même être conservées.

#监控系统 #Automatisation