Skip to main content
Une version plus récente de ce produit est disponible.
La version française est une traduction automatique. La version anglaise prévaut sur la française en cas de divergence.

Dépannez un système StorageGRID

Si vous rencontrez un problème lors de l'utilisation d'un système StorageGRID, reportez-vous aux conseils et aux directives de cette section pour obtenir de l'aide afin de déterminer et de résoudre le problème.

Souvent, vous pouvez résoudre les problèmes vous-même ; cependant, vous pourriez avoir besoin de faire appel au support technique pour certains problèmes.

Définissez le problème

La première étape pour résoudre un problème consiste à le définir clairement.

Ce tableau fournit des exemples de types d'informations que vous pourriez recueillir pour définir un problème :

Question Exemple de réponse

Que fait ou ne fait pas le système StorageGRID ? Quels sont ses symptômes ?

Les applications clientes signalent que les objets ne peuvent pas être ingérés dans StorageGRID.

Quand le problème a-t-il commencé ?

L'ingestion de l'objet a d'abord été refusée vers 14h50 le 8 janvier 2020.

Comment avez-vous remarqué le problème pour la première fois ?

Notifié par l'application cliente. Également reçu des notifications d'alerte par e-mail.

Le problème se produit-il systématiquement ou seulement parfois ?

Le problème persiste.

Si le problème se produit régulièrement, quelles étapes le provoquent

Le problème se produit chaque fois qu'un client tente d'ingérer un objet.

Si le problème se produit de manière intermittente, quand survient-il ? Consignez les heures de chaque incident dont vous avez connaissance.

Le problème n'est pas intermittent.

Avez-vous déjà rencontré ce problème ? À quelle fréquence avez-vous rencontré ce problème par le passé ?

C'est la première fois que je vois ce problème.

Évaluez le risque et l'impact sur le système

Une fois que vous avez défini le problème, évaluez son risque et son impact sur le système StorageGRID. Par exemple, la présence d’alertes critiques ne signifie pas nécessairement que le système ne fournit pas les services essentiels.

Ce tableau résume l'impact du problème illustré en exemple sur le fonctionnement du système :

Question Exemple de réponse

Le système StorageGRID peut-il ingérer du contenu ?

Non.

Les applications clientes peuvent-elles récupérer du contenu ?

Certains objets peuvent être récupérés et d'autres ne le peuvent pas.

Les données sont-elles en danger ?

Non.

La capacité à mener des activités commerciales est-elle gravement affectée ?

Oui, car les applications clientes ne peuvent pas stocker d'objets dans le système StorageGRID et les données ne peuvent pas être récupérées de manière cohérente.

Collecter des données

Après avoir défini le problème et évalué ses risques et son impact, collectez des données pour analyse. Le type de données le plus utile à collecter dépend de la nature du problème.

Type de données à collecter Pourquoi collecter ces données Instructions

Créer une chronologie des modifications récentes

Toute modification apportée à votre système StorageGRID, à sa configuration ou à son environnement peut entraîner un nouveau comportement.

Consulter les alertes

Les alertes peuvent vous aider à déterminer rapidement la cause première d'un problème en fournissant des indices importants sur les problèmes sous-jacents qui pourraient en être la cause.

Consultez la liste des alertes en cours pour voir si StorageGRID a identifié la cause première d’un problème pour vous.

Consultez les alertes déclenchées par le passé pour obtenir des informations supplémentaires.

Établissez des lignes de base

Recueillez des informations sur les niveaux normaux des différentes valeurs opérationnelles. Ces valeurs de référence, ainsi que les écarts par rapport à celles-ci, peuvent fournir des indices précieux.

Effectuer des tests d'ingestion et de récupération

Pour résoudre les problèmes de performances liés à l'ingestion et à la récupération, utilisez une station de travail pour stocker et récupérer des objets. Comparez les résultats avec ceux obtenus lors de l'utilisation de l'application cliente.

Examiner les messages d'audit

Examinez les messages d'audit pour suivre en détail les opérations StorageGRID. Les détails des messages d'audit peuvent être utiles pour résoudre de nombreux types de problèmes, notamment les problèmes de performances.

Vérifiez l'emplacement des objets et l'intégrité du stockage

En cas de problèmes de stockage, vérifiez que les objets sont placés à l'emplacement prévu. Vérifiez l'intégrité des données des objets sur un nœud de stockage.

Collecte de données pour le support technique

Le support technique peut vous demander de collecter des données ou de consulter des informations spécifiques pour faciliter la résolution des problèmes.

Créer une chronologie des modifications récentes

Lorsqu'un problème survient, vous devez prendre en compte ce qui a changé récemment et quand ces changements se sont produits.

  • Toute modification apportée à votre système StorageGRID, à sa configuration ou à son environnement peut entraîner un nouveau comportement.

  • Une chronologie des modifications peut vous aider à identifier quelles modifications pourraient être à l'origine d'un problème et comment chaque modification a pu affecter son développement.

Créez un tableau des modifications récentes apportées à votre système, incluant des informations sur le moment où chaque modification a eu lieu et tout détail pertinent concernant la modification, comme des informations sur ce qui se passait également pendant la réalisation de la modification :

Heure du changement Type de changement Détails

Par exemple :

  • Quand avez-vous lancé la récupération du nœud ?

  • Quand la mise à jour du logiciel a-t-elle été terminée ?

  • Avez-vous interrompu le processus ?

Que s'est-il passé ? Qu'avez-vous fait ?

Documentez tous les détails pertinents concernant la modification. Par exemple :

  • Détails des modifications du réseau.

  • Quel correctif a été installé.

  • Évolution des charges de travail des clients.

Assurez-vous de noter si plus d'une modification se produisait en même temps. Par exemple, cette modification a-t-elle été effectuée alors qu'une mise à niveau était en cours ?

Exemples de changements récents importants

Voici quelques exemples de changements potentiellement importants :

  • Le système StorageGRID a-t-il été installé, étendu ou récupéré récemment ?

  • Le système a-t-il été mis à niveau récemment ? Un correctif a-t-il été appliqué ?

  • Du matériel a-t-il été réparé ou changé récemment ?

  • La politique ILM a-t-elle été mise à jour ?

  • La charge de travail du client a-t-elle changé ?

  • L'application cliente ou son comportement ont-ils changé ?

  • Avez-vous modifié les équilibreurs de charge, ou ajouté ou supprimé un groupe de haute disponibilité de nœuds d'administration ou de nœuds de passerelle ?

  • Des tâches dont l'exécution peut prendre beaucoup de temps ont-elles été démarrées ? Exemples :

    • Récupération d'un nœud de stockage défaillant

    • Mise hors service du nœud de stockage

  • Des modifications ont-elles été apportées à l'authentification des utilisateurs, comme l'ajout d'un tenant ou la modification de la configuration LDAP ?

  • La migration des données est-elle en cours ?

  • Les services de la plateforme ont-ils été activés ou modifiés récemment ?

  • La conformité a-t-elle été activée récemment ?

  • Des pools de stockage cloud ont-ils été ajoutés ou supprimés ?

  • Des modifications ont-elles été apportées à la compression ou au chiffrement ?

  • Des modifications ont-elles été apportées à l'infrastructure réseau ? Par exemple, aux VLAN, aux routeurs ou au DNS.

  • Des modifications ont-elles été apportées aux sources NTP ?

  • Des modifications ont-elles été apportées aux interfaces Grid, Admin ou Client Network ?

  • D'autres modifications ont-elles été apportées au système StorageGRID ou à son environnement ?

Établissez des lignes de base

Vous pouvez établir des points de référence pour votre système en enregistrant les niveaux normaux de diverses valeurs opérationnelles. À l'avenir, vous pourrez comparer les valeurs actuelles à ces points de référence pour vous aider à détecter et à résoudre les valeurs anormales.

Propriété Valeur Comment obtenir

Consommation moyenne de stockage

Go consommés/jour

Pourcentage consommé par jour

Accédez au Gestionnaire de grille. Sur la page Nœuds, sélectionnez la grille entière ou un site et accédez à l'onglet Stockage.

Sur le graphique Stockage utilisé - Données d'objet, recherchez une période où la ligne est relativement stable. Positionnez votre curseur sur le graphique pour estimer la quantité de stockage consommée chaque jour

Vous pouvez collecter ces informations pour l'ensemble du système ou pour un centre de données spécifique.

Consommation moyenne de métadonnées

Go consommés/jour

Pourcentage consommé par jour

Accédez au Gestionnaire de grille. Sur la page Nœuds, sélectionnez la grille entière ou un site et accédez à l'onglet Stockage.

Sur le graphique « Stockage utilisé - Métadonnées des objets », repérez une période où la courbe est relativement stable. Placez votre curseur sur le graphique pour estimer la quantité de stockage de métadonnées consommée chaque jour.

Vous pouvez collecter ces informations pour l'ensemble du système ou pour un centre de données spécifique.

Taux des opérations S3

Opérations/seconde

Sur le tableau de bord Grid Manager, sélectionnez Performance > S3 operations for Storage Nodes.

Pour consulter les taux et les nombres d'ingestion et de récupération pour un site ou un nœud spécifique, sélectionnez Nodes > site or Storage Node > Objects. Placez votre curseur sur le graphique d'ingestion et de récupération S3.

taux d'évaluation ILM

Objets/seconde

Depuis la page Nodes, sélectionnez grid > ILM.

Sur le graphique ILM Queue, recherchez une période où la ligne est relativement stable. Positionnez votre curseur sur le graphique pour estimer une valeur de référence pour le taux d'évaluation (Evaluation rate) de votre système.

Taux de balayage ILM

Objets/seconde

Sélectionnez Nœuds > grid > ILM.

Sur le graphique ILM Queue, recherchez une période où la ligne est relativement stable. Positionnez votre curseur sur le graphique pour estimer une valeur de référence pour le taux de balayage de votre système.

Objets mis en file d'attente suite aux opérations du client

Objets/seconde

Sélectionnez Nœuds > grid > ILM.

Sur le graphique de la file d'attente ILM, recherchez une période au cours de laquelle la courbe est relativement stable. Placez votre curseur sur le graphique pour estimer une valeur de référence pour Objets mis en file d'attente (à partir des opérations client) pour votre système.

Latence moyenne des requêtes

Millisecondes

Sélectionnez Nœuds > Nœud de stockage > Objets. Dans le tableau Requêtes, consultez la valeur de Latence moyenne.

Analyser les données

Utilisez les informations que vous recueillez pour déterminer la cause du problème et les solutions potentielles.

L'analyse dépend du problème, mais en général :

  • Identifiez les points de défaillance et les goulots d'étranglement grâce aux alertes.

  • Reconstituez l'historique du problème à l'aide de l'historique des alertes et des graphiques.

  • Utilisez des graphiques pour détecter les anomalies et comparez la situation problématique avec le fonctionnement normal.

Liste de contrôle des informations d'escalade

Si vous ne parvenez pas à résoudre le problème vous-même, contactez l'assistance technique. Avant de contacter l'assistance technique, rassemblez les informations indiquées dans le tableau ci-dessous afin de faciliter la résolution du problème.

coche Article Remarques

Énoncé du problème

Quels sont les symptômes du problème ? Quand le problème a-t-il commencé ? Se produit-il de manière constante ou intermittente ? S'il est intermittent, à quels moments s'est-il produit ?

Évaluation d'impact

Quelle est la gravité du problème ? Quel est l’impact sur l’application cliente ?

  • Le client s'est-il déjà connecté avec succès ?

  • Le client peut-il ingérer, récupérer et supprimer des données ?

ID du système StorageGRID

Sélectionnez Maintenance > Système > Licence. L'ID système StorageGRID est affiché dans la licence actuelle.

Version du logiciel

En haut du Gestionnaire de grille, sélectionnez l'icône d'aide et sélectionnez À propos pour afficher la version de StorageGRID.

Personnalisation

Résumez la configuration de votre système StorageGRID. Par exemple, listez les éléments suivants :

  • Le grid utilise-t-il la compression du stockage, le chiffrement du stockage ou la conformité ?

  • L'ILM crée-t-il des objets répliqués ou codés par effacement ? L'ILM garantit-il la redondance de site ? Les règles ILM utilisent-elles les comportements d'ingestion Balanced, Strict ou Dual Commit ?

Fichiers journaux et données système

Collectez les fichiers journaux et les données système de votre système. Sélectionnez Assistance > Outils > Collecte des journaux.

Vous pouvez collecter les journaux pour l'ensemble de la grille ou pour des nœuds sélectionnés.

Si vous collectez des journaux uniquement pour certains nœuds, veillez à inclure au moins un nœud de stockage disposant du service ADC. Les trois premiers nœuds de stockage installés sur un site incluent le service ADC.

Informations de base

Collectez des informations de base concernant les opérations d'ingestion, les opérations de récupération et la consommation de stockage.

Chronologie des changements récents

Créez une chronologie récapitulant les modifications récentes apportées au système ou à son environnement.

Historique des efforts déployés pour diagnostiquer le problème

Si vous avez entrepris des démarches pour diagnostiquer ou résoudre vous-même le problème, veillez à consigner les étapes suivies et le résultat obtenu.