Systemüberprüfungen, die vor dem Zurücksetzen eines ONTAP Clusters durchgeführt werden müssen
Vor dem Zurücksetzen eines ONTAP Clusters empfiehlt sich die Überprüfung des Clusterzustands, des Speicherzustands und der Systemzeit. Zudem sollte überprüft werden, dass keine Jobs auf dem Cluster laufen.
Clusterzustand überprüfen
Bevor ein ONTAP Cluster zurückgesetzt wird, sollte überprüft werden, ob die Knoten fehlerfrei sind und zur Teilnahme am Cluster berechtigt sind sowie ob sich der Cluster im Quorum befindet.
-
Es sollte sichergestellt werden, dass die Knoten im Cluster online sind und zur Teilnahme am Cluster berechtigt sind:
cluster showIn diesem Beispiel sind alle Knoten fehlerfrei und zur Teilnahme am Cluster berechtigt.
cluster1::> cluster show Node Health Eligibility --------------------- ------- ------------ node0 true true node1 true true
Wenn ein Knoten fehlerhaft oder nicht geeignet ist, sollten die EMS-Protokolle auf Fehler überprüft und Korrekturmaßnahme ergriffen werden.
-
Stellen Sie die Berechtigungsstufe auf „Erweitert“ ein:
set -privilege advancedGeben Sie
yein, um fortzufahren. -
Die Konfigurationsdetails für jeden RDB-Prozess werden überprüft.
-
Die relationalen Datenbank-Epochen und die Datenbank-Epochen sollten für jeden Knoten übereinstimmen.
-
Das primäre Quorum pro Ring sollte für alle Knoten gleich sein.
Beachten Sie, dass jeder Ring ein anderes Quorum-Primary haben kann.
Um diesen RDB-Prozess anzuzeigen… Geben Sie diesen Befehl ein… Verwaltungsanwendung
cluster ring show -unitname mgmtVolume-Standortdatenbank
cluster ring show -unitname vldbManager für virtuelle Schnittstellen
cluster ring show -unitname vifmgrSAN Management-Daemon
cluster ring show -unitname bcomdDieses Beispiel zeigt den Volume Location Database-Prozess:
cluster1::*> cluster ring show -unitname vldb Node UnitName Epoch DB Epoch DB Trnxs Master Online --------- -------- -------- -------- -------- --------- --------- node0 vldb 154 154 14847 node0 master node1 vldb 154 154 14847 node0 secondary node2 vldb 154 154 14847 node0 secondary node3 vldb 154 154 14847 node0 secondary 4 entries were displayed.
-
-
Zurück zur Administrator-Privilegstufe:
set -privilege admin -
Wenn Sie in einer SAN-Umgebung arbeiten, überprüfen Sie, ob sich jeder Knoten in einem SAN-Quorum befindet:
event log show -severity informational -message-name scsiblade.*Die aktuellste scsi-blade-Ereignismeldung für jeden Knoten sollte anzeigen, dass sich das scsi-blade im Quorum befindet.
cluster1::*> event log show -severity informational -message-name scsiblade.* Time Node Severity Event --------------- ---------- -------------- --------------------------- MM/DD/YYYY TIME node0 INFORMATIONAL scsiblade.in.quorum: The scsi-blade ... MM/DD/YYYY TIME node1 INFORMATIONAL scsiblade.in.quorum: The scsi-blade ...
Speicherzustand überprüfen
Bevor Sie einen ONTAP Cluster zurücksetzen, sollte der Status Ihrer Festplatten, Aggregate und Volumes überprüft werden.
-
Festplattenstatus überprüfen:
Zur Überprüfung, ob… Folgendes ist zu tun… Defekte Festplatten
-
Alle defekten Datenträger anzeigen:
storage disk show -state broken -
Beschädigte Datenträger entfernen oder ersetzen.
Festplatten, die sich in Wartung oder Wiederherstellung befinden
-
Alle Datenträger im Wartungs-, Ausstehend- oder Wiederherstellungsstatus anzeigen:
storage disk show -state maintenance
pending
reconstructing ---- .. Es sollte abgewartet werden, bis die Wartungs- oder Wiederherstellungsarbeiten abgeschlossen sind, bevor fortgefahren wird.
-
-
Es sollte sichergestellt werden, dass alle Speicheraggregate online sind, indem der Status des physischen und logischen Speichers, einschließlich der Speicheraggregate, angezeigt wird:
storage aggregate show -state !onlineDieser Befehl zeigt die Aggregate an, die nicht online sind. Alle Aggregate müssen vor und nach einer größeren Aktualisierung oder Rücksetzung online sein.
cluster1::> storage aggregate show -state !online There are no entries matching your query.
-
Es kann überprüft werden, ob alle Volumes online sind, indem alle Volumes angezeigt werden, die nicht online sind:
volume show -state !onlineAlle Volumes müssen vor und nach einer größeren Aktualisierung oder Rücksetzung online sein.
cluster1::> volume show -state !online There are no entries matching your query.
-
Es wird überprüft, ob keine inkonsistenten Volumes vorhanden sind:
volume show -is-inconsistent trueSiehe die "NetApp Knowledge Base: Volumen zeigt WAFL als inkonsistent" Hinweise zum Umgang mit den uneinheitlichen Volumen.
Systemzeit überprüfen
Bevor ein ONTAP Cluster zurückgesetzt wird, sollte überprüft werden, ob NTP konfiguriert ist und die Zeit im gesamten Cluster synchronisiert ist.
-
Es sollte überprüft werden, ob der Cluster mit einem NTP-Server verbunden ist:
cluster time-service ntp server show -
Es sollte sichergestellt sein, dass jeder Knoten das gleiche Datum und die gleiche Uhrzeit hat:
cluster date showcluster1::> cluster date show Node Date Timezone --------- ------------------- ------------------------- node0 4/6/2013 20:54:38 GMT node1 4/6/2013 20:54:38 GMT node2 4/6/2013 20:54:38 GMT node3 4/6/2013 20:54:38 GMT 4 entries were displayed.
Es sollte sichergestellt sein, dass keine Jobs ausgeführt werden.
Bevor Sie einen ONTAP Cluster zurücksetzen, sollte der Status der Cluster-Jobs überprüft werden. Wenn Aggregate-, Volume-, NDMP- (Dump- oder Restore-) oder Snapshot-Jobs (wie Erstellen, Löschen, Verschieben, Ändern, Replizieren und Mounten) ausgeführt werden oder in der Warteschlange stehen, sollten die Jobs erfolgreich abgeschlossen werden oder die Einträge in der Warteschlange gestoppt werden.
-
Die Liste aller laufenden oder in der Warteschlange befindlichen Aggregate-, Volume- oder Snapshot-Jobs kann eingesehen werden:
job showIn diesem Beispiel befinden sich zwei Aufträge in der Warteschlange:
cluster1::> job show Owning Job ID Name Vserver Node State ------ -------------------- ---------- -------------- ---------- 8629 Vol Reaper cluster1 - Queued Description: Vol Reaper Job 8630 Certificate Expiry Check cluster1 - Queued Description: Certificate Expiry Check -
Alle laufenden oder in der Warteschlange befindlichen Aggregate-, Volume- oder Snapshot-Jobs löschen:
job delete -id <job_id> -
Es sollte sichergestellt sein, dass keine Aggregate-, Volume- oder Snapshot-Jobs ausgeführt werden oder in der Warteschlange stehen:
job showIn diesem Beispiel wurden alle laufenden und in der Warteschlange befindlichen Jobs gelöscht:
cluster1::> job show Owning Job ID Name Vserver Node State ------ -------------------- ---------- -------------- ---------- 9944 SnapMirrorDaemon_7_2147484678 cluster1 node1 Dormant Description: Snapmirror Daemon for 7_2147484678 18377 SnapMirror Service Job cluster1 node0 Dormant Description: SnapMirror Service Job 2 entries were displayed