Alertes dans StorageGRID
Cette référence répertorie les alertes par défaut qui s'affichent dans le Grid Manager. Les actions recommandées figurent dans le message d'alerte que vous recevez.
${post_edited_translations.segment}
Certaines alertes par défaut utilisent "Métriques Prometheus".
Alertes d'appliance
| Nom de l'alerte | Description |
|---|---|
Batterie de l'appareil expirée |
La batterie du contrôleur de stockage de l'appareil a expiré. |
${post_edited_translations.segment} |
${post_edited_translations.segment} |
${post_edited_translations.segment} |
La batterie du contrôleur de stockage de l'appareil a une capacité apprise insuffisante. |
${post_edited_translations.segment} |
La pile du contrôleur de stockage de l'appareil arrive bientôt à expiration. |
${post_edited_translations.segment} |
La pile du contrôleur de stockage de l'appareil est manquante. |
La batterie de l'appareil est trop chaude |
La batterie du contrôleur de stockage de l'appareil est en surchauffe. |
Erreur de communication BMC de l'appliance |
${post_edited_translations.segment} |
${post_edited_translations.segment} |
${post_edited_translations.segment} |
${post_edited_translations.segment} |
Un périphérique de sauvegarde de cache persistant a échoué. |
Capacité insuffisante du périphérique de sauvegarde du cache de l'appliance |
La capacité du périphérique de sauvegarde du cache est insuffisante. |
${post_edited_translations.segment} |
${post_edited_translations.segment} |
${post_edited_translations.segment} |
${post_edited_translations.segment} |
Défaut de la pile CMOS de l'appareil |
${post_edited_translations.segment} |
${post_edited_translations.segment} |
${post_edited_translations.segment} |
Température du processeur du contrôleur de calcul de l'appareil trop élevée |
La température du processeur du contrôleur de calcul dans une appliance StorageGRID a dépassé un seuil nominal. |
Le contrôleur de calcul de l'appliance nécessite une attention particulière. |
Un défaut matériel a été détecté dans le contrôleur de calcul d'une appliance StorageGRID. |
L'alimentation du contrôleur de calcul de l'appliance A présente un problème |
L'alimentation A du contrôleur informatique présente un problème. |
${post_edited_translations.segment} |
${post_edited_translations.segment} |
Service de surveillance du matériel informatique de l'appliance bloqué |
${post_edited_translations.segment} |
Le disque DAS de l'appliance a dépassé la limite de données écrites par jour |
Une quantité excessive de données est écrite chaque jour sur le disque, ce qui pourrait annuler sa garantie. |
${post_edited_translations.segment} |
${post_edited_translations.segment} |
Le lecteur DAS de l'appliance est dans le mauvais emplacement ou nœud |
Un disque de stockage à connexion directe (DAS) se trouve dans le mauvais emplacement ou nœud |
${post_edited_translations.segment} |
${post_edited_translations.segment} |
${post_edited_translations.segment} |
Un disque de stockage à connexion directe (DAS) est en cours de reconstruction. Ceci est attendu s'il a été récemment remplacé ou retiré/réinséré. |
Défaut du ventilateur de l'appareil détecté |
Un problème avec une unité de ventilation dans l'appareil a été détecté. |
Défaut Fibre Channel détecté sur l'appareil |
Un problème de liaison Fibre Channel a été détecté entre le contrôleur de stockage de l'appliance et le contrôleur de calcul |
Défaillance du port HBA Fibre Channel de l'appareil |
Un port HBA Fibre Channel est en panne ou a échoué. |
Disques cache flash d'appliance non optimaux |
Les disques utilisés pour le cache SSD ne sont pas optimaux. |
Interconnexion de l'appareil/boîtier de batterie retiré |
Le boîtier d'interconnexion/batterie est manquant. |
Port LACP manquant sur l'appliance |
Un port d'un appareil StorageGRID ne participe pas à la liaison LACP. |
Défaut de carte réseau de l'appareil détecté |
Un problème avec une carte d'interface réseau (NIC) dans l'appareil a été détecté. |
L'alimentation électrique globale de l'appareil est dégradée |
La puissance d'un appareil StorageGRID s'est écartée de la tension de fonctionnement recommandée. |
Mise à jour du logiciel SANtricity OS requise |
La version du logiciel SANtricity est inférieure à la version minimale recommandée pour cette version de StorageGRID. |
Avertissement critique concernant le SSD de l'appliance |
Un SSD d'appliance signale un avertissement critique. |
Panne du contrôleur de stockage de l'appliance A |
Le contrôleur de stockage A dans une appliance StorageGRID est en panne. |
panne du contrôleur de stockage de l'appliance B |
Le contrôleur de stockage B dans une appliance StorageGRID est en panne. |
Panne disque du contrôleur de stockage de l'appliance |
Un ou plusieurs disques durs dans une appliance StorageGRID sont en panne ou ne sont pas optimaux. |
Problème matériel du contrôleur de stockage de l'appliance |
Le logiciel SANtricity signale « Nécessite une attention » pour un composant dans une appliance StorageGRID. |
Panne de l'alimentation du contrôleur de stockage de l'appliance |
L'alimentation électrique A dans un appareil StorageGRID a dévié de la tension de fonctionnement recommandée. |
panne d'alimentation du contrôleur de stockage de l'appliance B |
L'alimentation B dans un appareil StorageGRID a dévié de la tension de fonctionnement recommandée. |
Service de surveillance du matériel de stockage d'appliance bloqué |
${post_edited_translations.segment} |
Étagères de stockage de l'appliance dégradées |
L'état de l'un des composants de l'étagère de stockage d'un appareil de stockage est dégradé. |
La température de l'appareil a été dépassée |
La température nominale ou maximale du contrôleur de stockage de l'appareil a été dépassée. |
Capteur de température de l'appareil retiré |
Un capteur de température a été retiré. |
Erreur de démarrage sécurisé UEFI de l'appliance |
L'appareil n'a pas été démarré de manière sécurisée. |
Les E/S disque sont très lentes |
Des E/S disque très lentes peuvent impacter les performances du grid. |
Défaut détecté au niveau du ventilateur de l'appareil de stockage |
Un problème a été détecté au niveau d'une unité de ventilation dans le contrôleur de stockage d'un appareil. |
Connectivité de stockage de l'appliance de stockage dégradée |
Il existe un problème avec une ou plusieurs connexions entre le contrôleur de calcul et le contrôleur de stockage. |
Périphérique de stockage inaccessible |
Impossible d'accéder au périphérique de stockage. |
Alertes d'audit et de syslog
| Nom de l'alerte | Description |
|---|---|
Les journaux d'audit sont ajoutés à la file d'attente en mémoire |
Le nœud ne peut pas envoyer de journaux au serveur syslog local et la file d'attente en mémoire se remplit. |
Erreur de transfert du serveur syslog externe |
Le nœud ne peut pas transférer les journaux vers le serveur syslog externe. |
Grande file d'attente d'audit |
La file d'attente disque pour les messages d'audit est pleine. Si ce problème n'est pas résolu, les opérations S3 risquent d'échouer. |
Les journaux sont ajoutés à la file d'attente sur disque |
Le nœud ne peut pas transférer les journaux vers le serveur syslog externe et la file d'attente sur disque se remplit. |
Alertes de compartiment
| Nom de l'alerte | Description |
|---|---|
FabricPool Le compartiment a un paramètre de cohérence non pris en charge. |
Un compartiment FabricPool utilise le niveau de cohérence Available ou Strong-site, qui n'est pas pris en charge. |
FabricPool Le compartiment possède un paramètre de versionnage non pris en charge |
Un compartiment FabricPool a le versionnage ou le verrouillage d'objet S3 activé, ce qui n'est pas pris en charge. |
Alertes Cassandra
| Nom de l'alerte | Description |
|---|---|
Erreur d'auto-compactage de Cassandra |
Le compacteur automatique Cassandra a rencontré une erreur. |
Métriques de l'auto-compacteur Cassandra obsolètes |
Les indicateurs qui décrivent l'auto-compacteur de Cassandra sont obsolètes. |
Erreur de communication Cassandra |
Les nœuds qui exécutent le service Cassandra rencontrent des difficultés à communiquer entre eux. |
Les compactages Cassandra sont surchargés |
Le processus de compactage de Cassandra est surchargé. |
Erreur d'écriture surdimensionnée dans Cassandra |
Un processus interne de StorageGRID a envoyé à Cassandra une requête d'écriture trop volumineuse. |
Métriques de réparation Cassandra obsolètes |
Les indicateurs qui décrivent les tâches de réparation Cassandra sont obsolètes. |
La progression de la réparation Cassandra est lente |
La progression des réparations de la base de données Cassandra est lente. |
Service de réparation Cassandra indisponible |
Le service de réparation de Cassandra n'est pas disponible. |
corruption de la table Cassandra |
Cassandra a détecté une corruption de table. Cassandra redémarre automatiquement si elle détecte une corruption de table. |
Alertes du Cloud Storage Pool
| Nom de l'alerte | Description |
|---|---|
Erreur de connectivité du Cloud Storage Pool |
La vérification de l'état des Cloud Storage Pools a détecté une ou plusieurs nouvelles erreurs. |
Expiration de la certification de l’entité finale IAM Roles Anywhere |
Le certificat d’entité finale IAM Roles Anywhere est sur le point d’expirer. |
Alertes de réplication inter-grilles
| Nom de l'alerte | Description |
|---|---|
Échec permanent de la réplication inter-grilles |
Une erreur de réplication inter-grilles s'est produite qui nécessite une intervention de votre part pour être résolue. |
Ressources de réplication inter-grilles indisponibles |
Les demandes de réplication inter-grilles sont en attente car une ressource est indisponible. |
alertes DHCP
| Nom de l'alerte | Description |
|---|---|
Le bail DHCP a expiré |
Le bail DHCP sur une interface réseau a expiré. |
Le bail DHCP expire bientôt |
Le bail DHCP sur une interface réseau expire bientôt. |
Serveur DHCP indisponible |
Le serveur DHCP est indisponible. |
Alertes de débogage et de traçage
| Nom de l'alerte | Description |
|---|---|
Impact du débogage sur les performances |
Lorsque le mode débogage est activé, les performances du système peuvent être affectées négativement. |
Configuration de traçage activée |
Lorsque la configuration de traçage est activée, les performances du système peuvent être affectées négativement. |
Courriel et AutoSupport alertes
| Nom de l'alerte | Description |
|---|---|
AutoSupport Échec de l'envoi du message |
Le dernier message AutoSupport n'a pas pu être envoyé. |
Échec de la résolution du nom de domaine |
Le nœud StorageGRID n'a pas pu résoudre les noms de domaine. |
Échec de la notification par e-mail |
La notification par courriel pour une alerte n'a pas pu être envoyée. |
Compartiment de destination d'archivage des journaux introuvable |
Le compartiment de destination pour l'archivage des journaux est manquant, ce qui empêche l'archivage des journaux dans le compartiment de destination. |
Erreurs SNMP inform |
Erreurs lors de l'envoi des notifications SNMP inform vers une destination de trap. |
Accès externe SSH activé |
L'accès externe SSH a été activé depuis plus de 24 heures. |
Connexion SSH ou console détectée |
Au cours des dernières 24 heures, un utilisateur s'est connecté avec la console Web ou SSH. |
Alertes de codage d'effacement (EC)
| Nom de l'alerte | Description |
|---|---|
Échec du rééquilibrage EC |
La procédure de rééquilibrage de l’EC a échoué ou a été interrompue. |
défaillance de réparation EC |
Une opération de réparation des données EC a échoué ou a été interrompue. |
Réparation EC bloquée |
Une opération de réparation des données EC est au point mort. |
Erreur de vérification de fragment codé par effacement |
Les fragments codés par effacement ne peuvent plus être vérifiés. Les fragments corrompus pourraient ne pas être réparés. |
Alertes d'expiration des certificats
| Nom de l'alerte | Description |
|---|---|
Expiration du certificat d'autorité de certification du proxy d'administration |
Un ou plusieurs certificats dans le bundle d'autorité de certification (CA) du serveur proxy d'administration sont sur le point d'expirer. |
Expiration du certificat client |
Un ou plusieurs certificats clients sont sur le point d'expirer. |
Expiration du certificat serveur global pour S3 |
Le certificat serveur global pour S3 est sur le point d'expirer. |
Expiration du certificat du point de terminaison de l'équilibreur de charge |
Un ou plusieurs certificats de point de terminaison d'équilibrage de charge sont sur le point d'expirer. |
Expiration du certificat serveur pour l'interface de gestion |
Le certificat serveur utilisé pour l'interface de gestion est sur le point d'expirer. |
Expiration du certificat d'autorité de certification syslog externe |
Le certificat de l'autorité de certification (CA) utilisé pour signer le certificat du serveur syslog externe est sur le point d'expirer. |
Expiration du certificat du client syslog externe |
Le certificat client d'un serveur syslog externe est sur le point d'expirer. |
Expiration du certificat du serveur syslog externe |
Le certificat du serveur présenté par le serveur syslog externe est sur le point d'expirer. |
Alertes du réseau Grid
| Nom de l'alerte | Description |
|---|---|
Incompatibilité MTU du réseau Grid |
Le paramètre MTU pour l'interface Grid Network (eth0) diffère considérablement d'un nœud à l'autre dans la grille. |
Alertes de fédération de grille
| Nom de l'alerte | Description |
|---|---|
Expiration du certificat de fédération de grille |
Un ou plusieurs certificats de fédération de grille sont sur le point d'expirer. |
Échec de la connexion à la fédération du grid |
La connexion de fédération de grid entre le grid local et le grid distant ne fonctionne pas. |
Alertes de forte utilisation ou de latence élevée
| Nom de l'alerte | Description |
|---|---|
Utilisation élevée du tas Java |
Un pourcentage élevé de l'espace mémoire Java est utilisé. |
Latence élevée pour les requêtes de métadonnées |
Le temps moyen d'exécution des requêtes de métadonnées Cassandra est trop long. |
Alertes de fédération d'identité
| Nom de l'alerte | Description |
|---|---|
Échec de la synchronisation de la fédération d'identités |
Impossible de synchroniser les groupes fédérés et les utilisateurs à partir de la source d'identité. |
Échec de la synchronisation de la fédération d'identité pour un locataire |
Impossible de synchroniser les groupes fédérés et les utilisateurs à partir de la source d'identité configurée par un tenant. |
Alertes de gestion du cycle de vie de l'information (ILM)
| Nom de l'alerte | Description |
|---|---|
Placement ILM impossible |
Une instruction de placement dans une règle ILM ne peut pas être réalisée pour certains objets. |
Taux de balayage ILM faible |
Le taux d'analyse ILM est défini à moins de 100 objets/seconde. |
Alertes du serveur de gestion des clés (KMS)
| Nom de l'alerte | Description |
|---|---|
Expiration du certificat KMS CA |
Le certificat de l'autorité de certification (CA) utilisé pour signer le certificat du serveur de gestion de clés (KMS) est sur le point d'expirer. |
Expiration du certificat client KMS |
Le certificat client d'un serveur de gestion de clés est sur le point d'expirer |
Échec du chargement de la configuration KMS |
La configuration du serveur de gestion des clés existe, mais n'a pas pu être chargée. |
Erreur de connectivité KMS |
Un nœud d'appliance n'a pas pu se connecter au serveur de gestion des clés de son site. |
Nom de clé de chiffrement KMS introuvable |
Le serveur de gestion des clés configuré ne possède pas de clé de chiffrement correspondant au nom fourni. |
La rotation de la clé de chiffrement KMS a échoué |
Tous les volumes de l'appliance ont été déchiffrés avec succès, mais un ou plusieurs volumes n'ont pas pu être basculés vers la dernière clé. |
KMS n'est pas configuré |
Il n'existe pas de serveur de gestion de clés pour ce site. |
La clé KMS n'a pas pu déchiffrer le volume de l'appliance. |
Un ou plusieurs volumes sur un appareil avec chiffrement de nœud activé n'ont pas pu être déchiffrés avec la clé KMS actuelle. |
Expiration du certificat du serveur KMS |
Le certificat serveur utilisé par le serveur de gestion de clés (KMS) est sur le point d'expirer. |
Échec de la connectivité du serveur KMS |
Un nœud d'appliance n'a pas pu se connecter à un ou plusieurs serveurs du cluster de serveurs de gestion des clés de son site. |
Alertes de l'équilibreur de charge
| Nom de l'alerte | Description |
|---|---|
Connexions d’équilibrage de charge sans requête élevées |
Un pourcentage élevé de connexions aux points de terminaison de l'équilibreur de charge ont été déconnectées sans effectuer de requêtes. |
Alertes de décalage de l'horloge locale
| Nom de l'alerte | Description |
|---|---|
Décalage horaire important de l'horloge locale |
Le décalage entre l'horloge locale et l'heure du Network Time Protocol (NTP) est trop important. |
Alertes de mémoire ou d'espace insuffisant
| Nom de l'alerte | Description |
|---|---|
Capacité disque du journal des audits faible |
L'espace disponible pour les journaux des audits est insuffisant. Si ce problème n'est pas résolu, les opérations S3 risquent d'échouer. |
Mémoire disponible du nœud faible |
La quantité de RAM disponible sur un nœud est faible. |
Espace libre faible pour le pool de stockage |
L'espace disponible pour le stockage des données d'objets dans le nœud de stockage est faible. |
Mémoire de nœud installée faible |
La quantité de mémoire installée sur un nœud est faible. |
Faible stockage des métadonnées |
L'espace disponible pour le stockage des métadonnées des objets est faible. |
Capacité disque des métriques faible |
L'espace disponible pour la base de données de métriques est faible. |
Stockage des données d’objets faible |
L'espace disponible pour le stockage des données d'objets est faible. |
${post_edited_translations.segment} |
${post_edited_translations.segment} |
${post_edited_translations.segment} |
L'espace disponible sur le disque racine est faible. |
Capacité de données système faible |
L'espace disponible pour /var/local est insuffisant. Si ce problème n'est pas résolu, les opérations S3 risquent d'échouer. |
${post_edited_translations.segment} |
L'espace disponible dans le répertoire /tmp est faible. |
${post_edited_translations.segment}
| Nom de l'alerte | Description |
|---|---|
Quorum ADC non atteint |
Le nœud de stockage avec service ADC est hors ligne. Les opérations d'extension et de mise hors service sont bloquées jusqu'à ce que le quorum ADC soit rétabli. |
${post_edited_translations.segment} |
${post_edited_translations.segment} |
${post_edited_translations.segment} |
${post_edited_translations.segment} |
${post_edited_translations.segment} |
Échec de l'application de la configuration du pare-feu. |
Points de terminaison de l'interface de gestion en mode de repli |
Tous les points de terminaison de l'interface de gestion reviennent aux ports par défaut depuis trop longtemps. |
Erreur de connectivité réseau du nœud |
Des erreurs se sont produites lors du transfert de données entre les nœuds. |
${post_edited_translations.segment} |
Un pourcentage élevé des trames réseau reçues par un nœud contenait des erreurs. |
${post_edited_translations.segment} |
${post_edited_translations.segment} |
Nœud non verrouillé avec le serveur NTP |
Le nœud n'est pas verrouillé sur un serveur de protocole de temps réseau (NTP). |
${post_edited_translations.segment} |
Un ou plusieurs périphériques réseau sont hors service ou déconnectés. |
${post_edited_translations.segment} |
L'interface de l'appliance vers le réseau d'administration (eth1) est hors service ou déconnectée. |
${post_edited_translations.segment} |
Le port réseau d'administration 1 de l'appareil est hors service ou déconnecté. |
Lien de l'appliance de services en panne sur le réseau client |
L'interface de l'appliance vers le réseau client (eth2) est hors service ou déconnectée. |
${post_edited_translations.segment} |
Le port réseau 1 de l'appareil est hors service ou déconnecté. |
Liaison du dispositif de services interrompue sur le port réseau 2 |
${post_edited_translations.segment} |
Liaison du dispositif de services interrompue sur le port réseau 3 |
${post_edited_translations.segment} |
Liaison du dispositif de services interrompue sur le port réseau 4 |
${post_edited_translations.segment} |
Lien de l'appliance de stockage en panne sur le réseau d'administration |
L'interface de l'appliance vers le réseau d'administration (eth1) est hors service ou déconnectée. |
${post_edited_translations.segment} |
Le port réseau d'administration 1 de l'appareil est hors service ou déconnecté. |
${post_edited_translations.segment} |
L'interface de l'appliance vers le réseau client (eth2) est hors service ou déconnectée. |
${post_edited_translations.segment} |
Le port réseau 1 de l'appareil est hors service ou déconnecté. |
Lien de l'appliance de stockage hors service sur le port réseau 2 |
${post_edited_translations.segment} |
${post_edited_translations.segment} |
${post_edited_translations.segment} |
Lien de l'appliance de stockage désactivé sur le port réseau 4 |
${post_edited_translations.segment} |
${post_edited_translations.segment} |
Le service LDR sur un nœud de stockage ne peut pas passer à l'état souhaité en raison d'une erreur interne ou d'un problème lié au volume |
${post_edited_translations.segment} |
Le nombre de connexions TCP sur ce nœud approche le nombre maximal pouvant être suivi. |
Impossible de communiquer avec le nœud |
Un ou plusieurs services ne répondent pas, ou le nœud est inaccessible. |
${post_edited_translations.segment} |
Un nœud a redémarré de manière inattendue au cours des dernières 24 heures. |
${post_edited_translations.segment}
| Nom de l'alerte | Description |
|---|---|
${post_edited_translations.segment} |
${post_edited_translations.segment} |
Vérification de l'existence de l'objet bloquée |
La vérification de l'existence de l'objet est bloquée. |
Objets potentiellement perdus |
${post_edited_translations.segment} |
${post_edited_translations.segment} |
${post_edited_translations.segment} |
S3 PUT taille de l'objet trop grande |
${post_edited_translations.segment} |
${post_edited_translations.segment} |
${post_edited_translations.segment} |
Alertes de corruption d'objets
| Nom de l'alerte | Description |
|---|---|
Incompatibilité de taille d'objet |
${post_edited_translations.segment} |
${post_edited_translations.segment}
| Nom de l'alerte | Description |
|---|---|
${post_edited_translations.segment} |
Le nombre de requêtes en attente pour les services de la plateforme approche de sa capacité maximale. |
Services de plateforme indisponibles |
Trop peu de nœuds de stockage disposant du service RSM sont en cours d'exécution ou disponibles sur le site. |
Alertes de volume de stockage
| Nom de l'alerte | Description |
|---|---|
Le volume de stockage nécessite une attention |
Un volume de stockage est hors ligne et nécessite une intervention. |
Le volume de stockage doit être restauré |
${post_edited_translations.segment} |
${post_edited_translations.segment} |
Un volume de stockage est hors ligne depuis plus de 5 minutes. |
Tentative de remontage du volume de stockage |
Un volume de stockage était hors ligne et a déclenché un remontage automatique. Cela pourrait indiquer un problème de disque ou des erreurs de système de fichiers. |
La restauration du volume a échoué à démarrer la réparation des données répliquées |
${post_edited_translations.segment} |
${post_edited_translations.segment}
| Nom de l'alerte | Description |
|---|---|
${post_edited_translations.segment} |
La configuration du service nginx est non valide. La configuration précédente est maintenant utilisée. |
Service nginx-gw utilisant la configuration de sauvegarde |
La configuration du service nginx-gw n'est pas valide. La configuration précédente est désormais utilisée. |
${post_edited_translations.segment} |
${post_edited_translations.segment} |
Redémarrage requis pour activer FIPS |
${post_edited_translations.segment} |
Service SSH utilisant la configuration de sauvegarde |
La configuration du service SSH est invalide. La configuration précédente est désormais utilisée. |
Alertes locataires
| Nom de l'alerte | Description |
|---|---|
${post_edited_translations.segment} |
Un pourcentage élevé de l'espace de quota est utilisé. Cette règle est désactivée par défaut car elle pourrait générer un trop grand nombre de notifications. |