Latenzprobleme in Workload Factory für EDA analysieren
Erkannte Verzögerungen werden angezeigt, und automatisierte Tools unterstützen dabei, die Ursache zu finden und langsame Performance in Ihren FSx for ONTAP Volumes zu beheben.
Bevor Sie beginnen
Sie müssen "konfigurierte Latenzüberwachung" haben, bevor Sie Latenzereignisse anzeigen und analysieren können.
Volumen mit einer Latenz oberhalb des Schwellenwerts anzeigen
Die Tabelle „Volumes mit Latenz oberhalb des Schwellenwerts“ zeigt Volumes, die den Warn- oder kritischen Latenzschwellenwert überschritten haben.
-
Es wird nur der jeweils aktuellste Sicherheitsverstoß für jedes Volume angezeigt. Frühere Verstöße für dasselbe Volume werden nicht angezeigt.
-
Es werden maximal 200 Ereignisse angezeigt. Ältere Ereignisse werden entfernt, sobald neue hinzugefügt werden.
-
Ereignisse werden auch ohne Dateisystemverknüpfung angezeigt. Eine Verknüpfung ist erforderlich, um grundlegende Analysedetails anzuzeigen oder KI-Analysen auszuführen.
-
Melden Sie sich mit einem der folgenden Dienste an: "Konsolenerlebnisse"Die
-
Wählen Sie das Menü
und wählen Sie dann EDA aus. -
Wählen Sie die Registerkarte Latenz aus.
-
Die Informationen zu jedem Ereignis in der Tabelle werden angezeigt.
-
Um Details zu einem Latenzereignis anzuzeigen, wählen Sie das Ereignis in der Spalte Schweregrad aus. Dadurch wird ein Latenzanalyse-Panel für dieses Ereignis geöffnet.
-
Um die Tabelle zu sortieren, wählen Sie eine beliebige Spaltenüberschrift aus. Standardmäßig werden kritische Ereignisse zuerst nach Zeit sortiert angezeigt, gefolgt von Warnereignissen, ebenfalls nach Zeit sortiert.
-
Um ein oder mehrere Ereignisse zu verwerfen, wählen Sie neben dem jeweiligen Ereignis
Verwerfen. -
Um der Tabelle Spalten hinzuzufügen, wählen Sie
, wählen Sie die Spalten aus und wählen Sie Anwenden. -
Das Panel zur Latenzanalyse bietet einen schnellen Überblick über die Verletzung, einschließlich eines Latenzdiagramms und Steuerelementen für Zeitraum und Typ. Vollständige Analyse anzeigen öffnet die detaillierte Latenzanalyseseite mit Basisanalyse, optionaler KI-Analyse und zusätzlichen Diagrammen. Siehe "Latenztrends analysieren" für Details.
Analysiere ein Latenzereignis
Die Latenzanalyse ermöglicht es, schnell die Ursachen von Verlangsamungen zu identifizieren, ohne eine manuelle Untersuchung durchführen zu müssen.
|
|
Um KI-Analysen nutzen zu können, muss die von NetApp verwaltete KI aktiviert sein. Weitere Informationen finden sich unter "KI-Funktionen verwalten". |
Eine einfache Analyse hilft Ihnen, schnell die Ursachen für Verlangsamungen zu finden, ohne dass eine manuelle Untersuchung erforderlich ist.
Latenzanalyse-Panel
Ein Latenzereignis in der Spalte Schweregrad öffnet das Analysefenster für dieses Ereignis. Das Fenster enthält Registerkarten, die verschiedene Ansichten des Latenzereignisses bieten.
Die Verfügbarkeit der KI-Analyse hängt von Ihren Kontoeinstellungen ab. Wenn die von NetApp verwaltete KI aktiviert ist, kann die KI-Analyse ohne Einrichtung von Bedrock durchgeführt werden. Die KI-Analyse ist nicht verfügbar, wenn das monatliche Kreditlimit erreicht ist oder Ihr Administrator die KI-Funktionen deaktiviert.
-
Basis: Zeigt die Ergebnisse einer automatischen Analyse an. Bei Verknüpfung mit dem Dateisystem wird eine Aufschlüsselung der Komponenten angezeigt und die Komponente, die die Verzögerung verursacht, identifiziert. Besteht keine Verknüpfung, erfolgt eine Aufforderung, eine hinzuzufügen. Ein interaktives Latenzdiagramm der CloudWatch-Metriken für das betroffene Volume wird angezeigt. Es werden entweder Lese- oder Schreibmetriken angezeigt, abhängig davon, welcher Alarm das Ereignis ausgelöst hat. Verschiedene Zeiträume können ausgewählt und ein Filter verwendet werden, um alle, Lese-, Schreib- oder Metadatenoperationen anzuzeigen.
-
KI-Analyse: Zeigt eine tiefergehende Untersuchung zur Ermittlung der spezifischen Ursache und potenzieller Abhilfemaßnahmen.
-
Detaillierte Latenzanalyse: Zeigt interaktive Diagramme der CloudWatch-Metriken für das betroffene Volume. Diese Diagramme zeigen Latenz, IOPS und Durchsatz im Zeitverlauf. Es werden entweder Lese- oder Schreibmetriken angezeigt, abhängig davon, welcher Alarm das Ereignis ausgelöst hat. Verschiedene Zeiträume und ein Filter ermöglichen die Anzeige von Alle, Lese-, Schreib- oder Metadatenoperationen.
Detaillierte Anweisungen zur Verwendung der Diagramme sind unter "Latenztrends analysieren" zu finden.
Schritte
-
Suchen Sie auf der Registerkarte Latenz das Ereignis, das Sie analysieren möchten.
-
Wählen Sie in der Spalte Schweregrad ein Latenzereignis aus, um ein Analysefenster für dieses Ereignis zu öffnen.
-
Die Registerkarte Grundlagen wird angezeigt. Wenn eine Verbindung besteht, kann die Komponentenaufschlüsselung geöffnet werden, um die Ursache der Verzögerung zu sehen. Wenn keine Verbindung besteht, kann die Aufforderung ausgewählt werden, um eine Verbindung herzustellen und die Komponenten zu analysieren.
-
Im Tab KI-Analyse steht (sofern verfügbar) die Option Analysieren zur Verfügung, um die Ergebnisse einer tiefergehenden Untersuchung anzuzeigen, beispielsweise zu möglichen Daten- oder Clusterproblemen. Dies unterstützt die Bestimmung der spezifischen Ursache und potenzieller Abhilfemaßnahmen.
Die Ergebnisse einschließlich folgender Punkte werden angezeigt:
-
Mögliche Ursachenerklärung
-
Liste der betroffenen EC2-Clients
-
Empfohlene Abhilfemaßnahmen
-
-
Vollständige Analyse anzeigen zeigt die vollständigen Ergebnisse der KI-Analyse, einschließlich Leistungsdiagrammen, die Volumenlatenz, IOPS und Durchsatz aus CloudWatch-Metriken über den ausgewählten Zeitraum darstellen.
-
Die empfohlenen Schritte zur Behebung des Latenzproblems beachten.
-
Nachdem Sie die Änderungen vorgenommen haben, in der Tabelle der Latenzereignisse lässt sich überprüfen, ob das Problem behoben ist.
Best Practices
Beachten Sie diese Empfehlungen bei der Analyse von Latenzproblemen:
-
Trends überwachen: Die Tabelle der Volumes mit Latenz über dem Schwellenwert sollte regelmäßig überprüft werden, um Muster oder wiederkehrende Probleme zu erkennen, die auf Konfigurationsprobleme hindeuten könnten.
-
KI-Analysen strategisch einsetzen: KI-Analysen kommen bei der Datenprüfung zum Einsatz, wenn grundlegende Analysen dies nahelegen. KI-Analysen können tiefere Einblicke in komplexe Leistungsprobleme ermöglichen, die eine detaillierte Fehlerbehebung erfordern.
-
Überprüfung abgewiesener Ereignisse: Es empfiehlt sich, regelmäßig zu überprüfen, warum Ereignisse abgewiesen wurden, um festzustellen, ob Schwellenwerte angepasst oder das System verbessert werden sollte.
Für bewährte Methoden zur Analyse von Latenztrends siehe "Graphinterpretation".