Fonctionnement des seuils
Dans cette section, vous apprendrez comment la valeur d’une métrique devient un statut, ce que signifie chaque niveau de sévérité, et ce qui se passe lorsqu’un seuil est laissé vide.
Niveaux de sévérité
Chaque métrique possède trois seuils. Ils sont évalués du plus sévère au moins sévère, et le premier franchi l’emporte.
| Niveau | Couleur | Signification |
|---|---|---|
| critique | rouge | la valeur a franchi le seuil critique |
| majeur | orange | la valeur a franchi le seuil majeur |
| mineur | jaune | la valeur a franchi le seuil mineur |
| OK | vert | la valeur n’a franchi aucun des seuils configurés |
Pour qu’une métrique se comporte comme prévu, les trois valeurs doivent croître dans l’ordre : mineur < majeur < critique. Un seuil mineur supérieur au seuil majeur empêche le niveau majeur d’être signalé.
Un seuil vide signifie « non surveillé »
Un seuil laissé vide est non configuré, et Mugnsoft l’ignore entièrement lors de l’évaluation d’un statut. Il est affiché avec le symbole de l’infini.
L’évaluation se fait niveau par niveau. Vous pouvez configurer uniquement le seuil critique et laisser les seuils mineur et majeur vides : la valeur sera comparée au seul seuil critique et ne sera jamais signalée comme mineure ou majeure.
Note :
Une métrique dont les trois seuils sont vides est toujours signalée OK, quelle que soit sa valeur. C’est le comportement attendu : une métrique non configurée est tout de même collectée et tracée, elle ne déclenche simplement jamais d’alerte.
Si vous voulez qu’une métrique alerte, vous devez lui donner au moins un seuil, soit en saisissant une valeur fixe, soit en activant son auto-seuil.
Parce qu’un seuil vide est ignoré, une valeur de 0 est elle aussi traitée comme « non configurée ». Vous ne pouvez pas exprimer « alerter dès que la valeur dépasse zéro » en saisissant 0 dans le champ critique. Pour alerter sur toute valeur non nulle, saisissez plutôt un petit nombre positif.
Connaître l’unité avant de saisir une valeur
Les seuils sont comparés dans l’unité propre de la métrique, qui n’est pas toujours un pourcentage. Saisir un pourcentage là où des mégaoctets sont attendus est la cause la plus fréquente d’un composant sain signalé comme critique.
| Métrique | Portée | Unité |
|---|---|---|
| cpu, cpu user | système, processus | pourcentage |
| memory | système | pourcentage |
| memory (RSS), swap | processus | mégaoctets |
| iostat read, iostat write | processus | millisecondes |
| num threads, num FDs | processus | nombre |
| traffic in, traffic out | processus | kbits/s |
| filesystem, filesystem inodes | système | pourcentage |
| TCP sockets | système | nombre |
| swap-in rate, swap-out rate | système | octets/s |
| disk queue | système | longueur de file |
| disk util | système | pourcentage |
| disk read rate, disk write rate | système | Mo/s |
| net bytes rate | système | octets/s |
| net TX drops | système | pertes/s |
Note :
La mémoire d’un processus est comparée en mégaoctets, non en pourcentage de la mémoire système. Un seuil majeur de 3 sur la mémoire d’un processus signifie « 3 Mo », donc tout processus réel de l’hôte le franchira immédiatement.
Il n’existe pas de valeur universelle raisonnable pour la mémoire ou le swap d’un processus. Laissez-les vides et laissez l’auto-seuil apprendre la plage normale propre à chaque processus.
Les seuils de trafic sont différents
Les seuils de trafic d’un processus n’utilisent pas trois niveaux. Vous configurez plutôt, par processus et par direction :
- un opérateur,
>ou< - une valeur de seuil en kbits/s
- la sévérité à signaler lorsque le seuil est franchi
- une fenêtre de moyennage, le nombre d’échantillons consécutifs moyennés avant la comparaison
L’opérateur < est utile pour détecter un processus devenu silencieux : traffic in < 0.5 kbits/s → majeur alerte lorsqu’un service cesse de recevoir du trafic.
La fenêtre de moyennage lisse les pics brefs. Avec une fenêtre de 4, l’échantillon courant est moyenné avec les 3 précédents avant d’être comparé au seuil, de sorte qu’un pic isolé ne déclenche pas d’alerte tandis qu’un dépassement soutenu en déclenche toujours une. Les valeurs brutes sont toujours stockées telles quelles, seule la comparaison utilise la moyenne.
Où les seuils sont configurés
Les seuils des métriques système et processus se règlent sur le Discovery Agent, dans la page de détails du composant, sous les tableaux de seuils système et processus. Chaque ligne de métrique propose les trois valeurs fixes et un interrupteur d’auto-seuil.
Les valeurs appliquées à un instant donné sont affichées sous forme de pastilles en haut des panneaux de rapport système et processus, ce qui vous permet toujours de comparer ce qui est appliqué au graphique situé en dessous.
Voir aussi
- Auto-seuils — laissez le Discovery Agent apprendre la plage normale de chaque métrique
- Ajuster les seuils — diagnostiquer une métrique signalée avec le mauvais statut
- Surveillance système, processus, journaux et dossiers — d’où viennent les métriques évaluées par ces seuils
- Configuration du Discovery Agent — facteurs et fenêtres d’historique qui pilotent les auto-seuils