Skip to main content
Eine neuere Version dieses Produkts ist erhältlich.
Die deutsche Sprachversion wurde als Serviceleistung für Sie durch maschinelle Übersetzung erstellt. Bei eventuellen Unstimmigkeiten hat die englische Sprachversion Vorrang.

Fehlerbehebung in einem StorageGRID System

Änderungen vorschlagen

Sollten Sie bei der Verwendung eines StorageGRID Systems auf ein Problem stoßen, finden Sie in diesem Abschnitt Tipps und Hinweise zur Ermittlung und Behebung des Problems.

Oftmals können Sie Probleme selbst lösen; in manchen Fällen müssen Sie jedoch einige Probleme an den technischen Support eskalieren.

Das Problem definieren

Der erste Schritt zur Lösung eines Problems besteht darin, das Problem klar zu definieren.

Diese Tabelle enthält Beispiele für die Arten von Informationen, die Sie sammeln könnten, um ein Problem zu definieren:

Frage Beispielantwort

Was macht das StorageGRID-System bzw. was macht es nicht? Welche Symptome treten auf?

Clientanwendungen melden, dass Objekte nicht in StorageGRID aufgenommen werden können.

Wann hat das Problem begonnen?

Die Objektaufnahme wurde erstmals am 8. Januar 2020 gegen 14:50 Uhr abgelehnt.

Wie haben Sie das Problem zum ersten Mal bemerkt?

Benachrichtigung durch die Client-Anwendung. Es wurden außerdem Benachrichtigungen per E-Mail empfangen.

Tritt das Problem regelmäßig auf oder nur gelegentlich?

Das Problem besteht weiterhin.

Wenn das Problem regelmäßig auftritt, welche Schritte führen dazu?

Das Problem tritt jedes Mal auf, wenn ein Client versucht, ein Objekt zu ingestieren.

Falls das Problem nur sporadisch auftritt, wann genau tritt es auf? Notieren Sie die Uhrzeiten aller Ihnen bekannten Vorfälle.

Das Problem ist nicht sporadisch.

Ist Ihnen dieses Problem schon einmal begegnet? Wie oft hatten Sie dieses Problem in der Vergangenheit?

Dies ist das erste Mal, dass ich dieses Problem sehe.

Risiko und Auswirkungen auf das System bewerten

Nachdem Sie das Problem definiert haben, bewerten Sie dessen Risiko und Auswirkungen auf das StorageGRID System. Beispielsweise bedeutet das Vorhandensein kritischer Warnmeldungen nicht zwangsläufig, dass das System keine Kerndienste bereitstellt.

Diese Tabelle fasst die Auswirkungen des Beispielproblems auf den Systembetrieb zusammen:

Frage Beispielantwort

Kann das StorageGRID System Inhalte aufnehmen?

Nr.

Können Clientanwendungen Inhalte abrufen?

Manche Objekte können abgerufen werden, andere nicht.

Sind die Daten gefährdet?

Nr.

Ist die Fähigkeit zur Geschäftstätigkeit stark beeinträchtigt?

Ja, weil Clientanwendungen keine Objekte im StorageGRID System speichern können und Daten nicht konsistent abgerufen werden können.

Daten sammeln

Nachdem Sie das Problem definiert und dessen Risiken und Auswirkungen bewertet haben, werden Daten für die Analyse gesammelt. Die Art der Daten, die am nützlichsten zu sammeln ist, hängt von der Art des Problems ab.

Art der zu erfassenden Daten Warum werden diese Daten erfasst? Anweisungen

Zeitleiste der letzten Änderungen

Änderungen an Ihrem StorageGRID System, seiner Konfiguration oder seiner Umgebung können zu neuem Verhalten führen.

Benachrichtigungen überprüfen

Warnmeldungen können dabei unterstützen, die Ursache eines Problems schnell zu ermitteln, indem wichtige Hinweise auf die zugrunde liegenden Probleme gegeben werden, die das Problem verursachen könnten.

In der Liste der aktuellen Warnmeldungen kann geprüft werden, ob StorageGRID die Ursache eines Problems identifiziert hat.

Zusätzliche Erkenntnisse bieten die in der Vergangenheit ausgelösten Warnmeldungen.

Ausgangswerte festlegen

Informationen über die Normalwerte verschiedener Betriebskennzahlen sammeln. Diese Ausgangswerte und Abweichungen von diesen Ausgangswerten können wertvolle Hinweise liefern.

Ingest- und Abruftests durchführen

Zur Fehlerbehebung bei Leistungsproblemen beim Importieren und Abrufen empfiehlt sich die Verwendung einer Workstation zum Speichern und Abrufen von Objekten. Ein Vergleich der Ergebnisse mit denen bei Nutzung der Clientanwendung ist möglich.

Prüfmeldungen überprüfen

Audit-Meldungen bieten die Möglichkeit, StorageGRID-Vorgänge im Detail nachzuvollziehen. Die Details in den Audit-Meldungen können bei der Fehlerbehebung vieler Arten von Problemen, einschließlich Leistungsproblemen, nützlich sein.

Objektstandorte und Speicherintegrität überprüfen

Wenn Speicherprobleme auftreten, sollte überprüft werden, ob die Objekte an den erwarteten Stellen abgelegt werden. Die Integrität der Objektdaten auf einem Storage Node sollte überprüft werden.

Daten für den technischen Support sammeln

Der technische Support kann Sie bitten, Daten zu sammeln oder bestimmte Informationen zu überprüfen, um bei der Fehlerbehebung zu unterstützen.

Eine Zeitleiste der letzten Änderungen erstellen

Wenn ein Problem auftritt, sollte berücksichtigt werden, was sich in letzter Zeit geändert hat und wann diese Änderungen erfolgt sind.

  • Änderungen an Ihrem StorageGRID System, seiner Konfiguration oder seiner Umgebung können zu neuem Verhalten führen.

  • Eine Zeitleiste der Änderungen kann dabei helfen zu erkennen, welche Änderungen möglicherweise für ein Problem verantwortlich sind und wie sich jede Änderung auf dessen Entwicklung ausgewirkt haben könnte.

Eine Tabelle der letzten Änderungen an Ihrem System, die Informationen darüber enthält, wann jede Änderung erfolgte und alle relevanten Details zur Änderung, wie zum Beispiel Informationen darüber, was während der Durchführung der Änderung sonst noch geschah, kann erstellt werden:

Zeit des Wandels Art der Änderung Details

Beispiel:

  • Wann haben Sie die Knotenwiederherstellung gestartet?

  • Wann wurde das Software-Upgrade abgeschlossen?

  • Haben Sie den Vorgang unterbrochen?

Was ist passiert? Was haben Sie getan?

Dokumentieren Sie alle relevanten Details zur Änderung. Zum Beispiel:

  • Einzelheiten zu den Netzwerkänderungen.

  • Welcher Hotfix installiert wurde.

  • Wie sich die Arbeitslasten der Kunden verändert haben.

Achten Sie darauf, zu vermerken, ob mehr als eine Änderung gleichzeitig vorgenommen wurde. Wurde diese Änderung beispielsweise während eines laufenden Upgrades durchgeführt?

Beispiele für bedeutende Veränderungen in jüngster Zeit

Hier sind einige Beispiele für potenziell bedeutende Änderungen:

  • Wurde das StorageGRID System kürzlich installiert, erweitert oder wiederhergestellt?

  • Wurde das System kürzlich aktualisiert? Wurde ein Hotfix eingespielt?

  • Wurden in letzter Zeit Hardware repariert oder ausgetauscht?

  • Wurde die ILM Richtlinie aktualisiert?

  • Hat sich die Arbeitslast des Kunden verändert?

  • Hat sich die Client-Anwendung oder ihr Verhalten geändert?

  • Haben Sie die Load Balancer geändert oder eine Hochverfügbarkeitsgruppe von Admin Nodes oder Gateway Nodes hinzugefügt oder entfernt?

  • Wurden Aufgaben begonnen, deren Abschluss längere Zeit in Anspruch nehmen könnte? Beispiele hierfür sind:

    • Wiederherstellung eines ausgefallenen Storage Node

    • Stilllegung des Storage Node

  • Wurden Änderungen an der Benutzerauthentifizierung vorgenommen, wie zum Beispiel das Hinzufügen eines Mandanten oder die Änderung der LDAP-Konfiguration?

  • Findet eine Datenmigration statt?

  • Wurden die Plattformdienste kürzlich aktiviert oder geändert?

  • Wurde Compliance kürzlich aktiviert?

  • Wurden Cloud Storage Pools hinzugefügt oder entfernt?

  • Wurden Änderungen an der Speicherkomprimierung oder Verschlüsselung vorgenommen?

  • Gab es Änderungen an der Netzwerkinfrastruktur? Zum Beispiel VLANs, Router oder DNS.

  • Wurden Änderungen an den NTP-Quellen vorgenommen?

  • Wurden Änderungen an den Schnittstellen Grid, Admin oder Client Network vorgenommen?

  • Wurden am StorageGRID System oder seiner Umgebung weitere Änderungen vorgenommen?

Ausgangswerte festlegen

Sie können Referenzwerte für Ihr System festlegen, indem Sie die Normalwerte verschiedener Betriebsparameter erfassen. In Zukunft können die aktuellen Werte mit diesen Referenzwerten verglichen werden, um abnormale Werte zu erkennen und zu beheben.

Eigenschaft Wert Bezugsmöglichkeiten

Durchschnittlicher Speicherverbrauch

GB verbraucht/Tag

Prozent verbraucht/Tag

Gehen Sie zum Grid Manager. Auf der Seite „Knoten“ das gesamte Grid oder einen Standort auswählen und zur Registerkarte „Speicher“ wechseln.

Im Diagramm „Speicherbelegung – Objektdaten“ lässt sich ein Zeitraum erkennen, in dem die Linie relativ stabil verläuft. Mit dem Mauszeiger über dem Diagramm lässt sich abschätzen, wie viel Speicher täglich verbraucht wird.

Sie können diese Informationen für das gesamte System oder für ein bestimmtes Rechenzentrum erfassen.

Durchschnittlicher Metadatenverbrauch

GB verbraucht/Tag

Prozent verbraucht/Tag

Gehen Sie zum Grid Manager. Auf der Seite „Knoten“ das gesamte Grid oder einen Standort auswählen und zur Registerkarte „Speicher“ wechseln.

Im Diagramm „Speicherbelegung – Objektmetadaten“ lässt sich ein Zeitraum erkennen, in dem die Linie relativ stabil verläuft. Mit dem Mauszeiger über dem Diagramm kann abgeschätzt werden, wie viel Metadatenspeicher täglich genutzt wird.

Sie können diese Informationen für das gesamte System oder für ein bestimmtes Rechenzentrum erfassen.

Rate der S3-Operationen

Operationen pro Sekunde

Im Grid Manager Dashboard unter Performance > S3-Operationen für Storage Nodes auswählen.

Die Aufnahme- und Abrufraten sowie -anzahlen für einen bestimmten Standort oder Knoten sind unter Knoten > site oder Storage Node > Objekte zu finden. Der Mauszeiger kann über das Diagramm für S3 Ingest und Retrieve positioniert werden.

ILM Bewertungsrate

Objekte/Sekunde

Auf der Seite „Knoten“ die Option grid > ILM auswählen.

Im ILM-Warteschlangendiagramm lässt sich ein Zeitraum finden, in dem die Linie relativ stabil verläuft. Mit dem Cursor über dem Diagramm kann ein Basiswert für die Auswertungsrate des Systems abgeschätzt werden.

ILM Scanrate

Objekte/Sekunde

Wählen Sie Nodes > grid > ILM.

Im ILM-Warteschlangendiagramm lässt sich ein Zeitraum finden, in dem die Linie relativ stabil ist. Mit dem Cursor über dem Diagramm kann ein Basiswert für die Scan rate des Systems abgeschätzt werden.

Objekte, die von Clientoperationen in die Warteschlange gestellt wurden

Objekte/Sekunde

Wählen Sie Nodes > grid > ILM.

Im ILM-Warteschlangendiagramm lässt sich ein Zeitraum finden, in dem die Linie relativ stabil ist. Mit dem Cursor über dem Diagramm kann ein Basiswert für Objects queued (from client operations) für Ihr System abgeschätzt werden.

Durchschnittliche Abfragelatenz

Millisekunden

Wählen Sie Knoten > Speicherknoten > Objekte. In der Tabelle „Abfragen“ ist der Wert für die durchschnittliche Latenz ersichtlich.

Daten analysieren

Verwenden Sie die gesammelten Informationen, um die Ursache des Problems und mögliche Lösungen zu bestimmen.

Die Analyse ist problemabhängig, aber im Allgemeinen:

  • Fehlerquellen und Engpässe lassen sich mithilfe der Warnmeldungen identifizieren.

  • Die Problemhistorie lässt sich anhand des Alarmverlaufs und der Diagramme rekonstruieren.

  • Mithilfe von Diagrammen lassen sich Anomalien erkennen und die Problemsituation mit dem Normalbetrieb vergleichen.

Checkliste für Eskalationsinformationen

Wenn Sie das Problem nicht selbst lösen können, wenden Sie sich an den technischen Support. Vor der Kontaktaufnahme mit dem technischen Support sollten die in der folgenden Tabelle aufgeführten Informationen bereitgestellt werden, um die Problemlösung zu erleichtern.

Häkchen Artikel Hinweise

Problemstellung

Welche Symptome des Problems treten auf? Wann hat das Problem begonnen? Tritt es durchgehend oder nur gelegentlich auf? Falls nur gelegentlich, zu welchen Zeiten ist es aufgetreten?

Folgenabschätzung

Wie ist der Schweregrad des Problems? Welche Auswirkungen hat das auf die Client-Anwendung?

  • Hat der Client zuvor bereits erfolgreich eine Verbindung hergestellt?

  • Kann der Client Daten aufnehmen, abrufen und löschen?

StorageGRID System-ID

Wählen Sie Wartung > System > Lizenz. Die StorageGRID System-ID wird als Teil der aktuellen Lizenz angezeigt.

Softwareversion

Oben im Grid Manager das Hilfesymbol auswählen und anschließend Über, um die StorageGRID Version anzuzeigen.

Anpassung

Die Konfiguration Ihres StorageGRID Systems in einer Zusammenfassung. Beispielsweise können folgende Punkte aufgeführt werden:

  • Verwendet das Grid Speicherkomprimierung, Speicherverschlüsselung oder Compliance?

  • Erstellt ILM replizierte oder löschcodierte Objekte? Gewährleistet ILM Standortredundanz? Verwenden die ILM Regeln die Ingest-Verhaltensweisen Balanced, Strict oder Dual Commit?

Protokolldateien und Systemdaten

Protokolldateien und Systemdaten für Ihr System sammeln. Support > Tools > Log collection auswählen.

Sie können Protokolle für das gesamte Grid oder für ausgewählte Knoten sammeln.

Wenn Sie Protokolle nur für ausgewählte Knoten erfassen, stellen Sie sicher, dass mindestens ein Storage Node den ADC-Service enthält. Die ersten drei Storage Nodes, die an einem Standort installiert werden, enthalten den ADC-Service.

Basisinformationen

Basisinformationen zu Aufnahmevorgängen, Abrufvorgängen und Speicherverbrauch erfassen.

Zeitleiste der jüngsten Änderungen

Eine Zeitleiste, die alle kürzlich erfolgten Änderungen am System oder seiner Umgebung zusammenfasst.

Verlauf der Bemühungen zur Diagnose des Problems

Wenn Sie selbst Schritte unternommen haben, um das Problem zu diagnostizieren oder zu beheben, notieren Sie die durchgeführten Schritte und das Ergebnis.