Types de politiques de seuil de performance définies par le système
Unified Manager fournit certaines stratégies de seuil standard qui surveillent les performances du cluster et génèrent automatiquement des événements. Ces stratégies sont activées par défaut et génèrent des événements d’avertissement ou d’information lorsque les seuils de performances surveillés sont dépassés.
|
|
Les stratégies de seuil de performances définies par le système ne sont pas activées sur les systèmes Cloud Volumes ONTAP, ONTAP Edge ou ONTAP Select . |
Si vous recevez des événements inutiles provenant de stratégies de seuil de performances définies par le système, vous pouvez désactiver les événements pour des stratégies individuelles à partir de la page Configuration des événements.
Politiques de seuil de cluster
Les stratégies de seuil de performances de cluster définies par le système sont attribuées, par défaut, à chaque cluster surveillé par Unified Manager :
-
Déséquilibre de charge du cluster
Identifie les situations dans lesquelles un nœud fonctionne à une charge beaucoup plus élevée que les autres nœuds du cluster, ce qui affecte potentiellement les latences de charge de travail.
Pour ce faire, il compare la valeur de capacité de performance utilisée pour tous les nœuds d’un cluster afin de déterminer si un nœud a dépassé la valeur seuil de 30 % pendant plus de 24 heures. Il s’agit d’un événement d’avertissement.
-
Déséquilibre des capacités du cluster
Identifie les situations dans lesquelles un agrégat a une capacité utilisée beaucoup plus élevée que les autres agrégats du cluster, affectant ainsi potentiellement l'espace requis pour les opérations.
Cela se fait en comparant la valeur de capacité utilisée pour tous les agrégats du cluster pour voir s’il existe une différence de 70 % entre les agrégats. Il s’agit d’un événement d’avertissement.
Politiques de seuil de nœud
Les stratégies de seuil de performances des nœuds définies par le système sont attribuées, par défaut, à chaque nœud des clusters surveillés par Unified Manager :
-
Seuil de capacité de performance utilisé dépassé
Identifie les situations dans lesquelles un seul nœud fonctionne au-dessus des limites de son efficacité opérationnelle et affecte donc potentiellement les latences de charge de travail.
Il le fait en recherchant les nœuds qui utilisent plus de 100 % de leur capacité de performance pendant plus de 12 heures. Il s’agit d’un événement d’avertissement.
-
Paire de nœuds HA surutilisée
Identifie les situations dans lesquelles les nœuds d’une paire HA fonctionnent au-dessus des limites de l’efficacité opérationnelle de la paire HA.
Pour ce faire, il examine la valeur de la capacité de performance utilisée pour les deux nœuds de la paire HA. Si la capacité de performance combinée utilisée par les deux nœuds dépasse 200 % pendant plus de 12 heures, un basculement du contrôleur aura un impact sur les latences de la charge de travail. Il s'agit d'un événement informatif.
-
Fragmentation du disque du nœud
Identifie les situations dans lesquelles un ou plusieurs disques d'un agrégat sont fragmentés, ce qui ralentit les services système clés et affecte potentiellement les latences de charge de travail sur un nœud.
Il le fait en examinant certains ratios d’opérations de lecture et d’écriture sur tous les agrégats d’un nœud. Cette politique peut également être déclenchée lors de la resynchronisation de SyncMirror ou lorsque des erreurs sont détectées lors des opérations de nettoyage du disque. Il s’agit d’un événement d’avertissement.
La stratégie « Fragmentation du disque de nœud » analyse les agrégats HDD uniquement ; les agrégats Flash Pool, SSD et FabricPool ne sont pas analysés.
Politiques de seuil global
La stratégie de seuil de performance agrégée définie par le système est attribuée par défaut à chaque agrégat des clusters surveillés par Unified Manager :
-
Disques agrégés surutilisés
Identifie les situations dans lesquelles un agrégat fonctionne au-dessus des limites de son efficacité opérationnelle, affectant ainsi potentiellement les latences de charge de travail. Il identifie ces situations en recherchant des agrégats où les disques de l'agrégat sont utilisés à plus de 95 % pendant plus de 30 minutes. Cette politique multicondition effectue ensuite l’analyse suivante pour aider à déterminer la cause du problème :
-
Un disque de l’agrégat subit-il actuellement une activité de maintenance en arrière-plan ?
Certaines des activités de maintenance en arrière-plan qu'un disque peut subir sont la reconstruction du disque, le nettoyage du disque, la resynchronisation SyncMirror et la réparation.
-
Existe-t-il un goulot d'étranglement des communications dans l'interconnexion Fibre Channel de l'étagère de disques ?
-
Y a-t-il trop peu d'espace libre dans l'ensemble ? Un événement d'avertissement est émis pour cette politique uniquement si une (ou plusieurs) des trois politiques subordonnées sont également considérées comme violées. Un événement de performance n'est pas déclenché si seuls les disques de l'ensemble sont utilisés à plus de 95 %.
-
|
|
La stratégie « Disques agrégés surutilisés » analyse les agrégats HDD uniquement et les agrégats Flash Pool (hybrides) ; les agrégats SSD et FabricPool ne sont pas analysés. |
Politiques de seuil de latence de la charge de travail
Les stratégies de seuil de latence de charge de travail définies par le système sont attribuées à toute charge de travail disposant d'une stratégie de niveau de service de performances configurée avec une valeur de « latence attendue » définie :
-
Seuil de latence du volume de charge de travail/LUN dépassé tel que défini par le niveau de service de performance
Identifie les volumes (partages de fichiers) et les LUN qui ont dépassé leur limite de « latence attendue » et qui affectent les performances de la charge de travail. Il s’agit d’un événement d’avertissement.
Pour ce faire, il recherche les charges de travail qui ont dépassé la valeur de latence attendue pendant 30 % du temps au cours de l’heure précédente.
Politiques de seuil de qualité de service
Les stratégies de seuil de performances QoS définies par le système sont attribuées à toute charge de travail disposant d'une stratégie de débit maximal QoS ONTAP configurée (IOPS, IOPS/To ou Mo/s). Unified Manager déclenche un événement lorsque la valeur de débit de la charge de travail est inférieure de 15 % à la valeur QoS configurée :
-
Seuil QoS Max IOPS ou MB/s
Identifie les volumes et les LUN qui ont dépassé leur limite maximale d'IOPS ou de débit en Mo/s de QoS et qui affectent la latence de la charge de travail. Il s’agit d’un événement d’avertissement.
Lorsqu'une charge de travail unique est attribuée à un groupe de politiques, elle le fait en recherchant les charges de travail qui ont dépassé le seuil de débit maximal défini dans le groupe de politiques QoS attribué au cours de chaque période de collecte de l'heure précédente.
Lorsque plusieurs charges de travail partagent une même politique QoS, le système le fait en ajoutant les IOPS ou les Mo/s de toutes les charges de travail de la politique et en vérifiant ce total par rapport au seuil.
-
QoS Peak IOPS/To ou IOPS/To avec seuil de taille de bloc
Identifie les volumes qui ont dépassé leur limite de débit IOPS/To de pointe QoS adaptative (ou IOPS/To avec limite de taille de bloc) et qui affectent la latence de la charge de travail. Il s’agit d’un événement d’avertissement.
Pour ce faire, il convertit le seuil IOPS/To de pointe défini dans la politique QoS adaptative en une valeur IOPS maximale QoS basée sur la taille de chaque volume, puis il recherche les volumes qui ont dépassé le seuil IOPS maximal QoS pendant chaque période de collecte des performances pour l'heure précédente.
Cette politique s'applique aux volumes uniquement lorsque le cluster est installé avec le logiciel ONTAP 9.3 et versions ultérieures.
Lorsque l'élément « taille de bloc » a été défini dans la politique QoS adaptative, le seuil est converti en une valeur maximale QoS en Mo/s en fonction de la taille de chaque volume. Il recherche ensuite les volumes qui ont dépassé le débit maximal QoS en Mo/s au cours de chaque période de collecte des performances de l'heure précédente.
Cette politique s'applique aux volumes uniquement lorsque le cluster est installé avec le logiciel ONTAP 9.5 et versions ultérieures.