此產品有較新版本可以使用。
本繁體中文版使用機器翻譯,譯文僅供參考,若與英文版本牴觸,應以英文版本為準。
恢復隔離的 StorageGRID 節點的網路連線
在某些情況下,一個或多個節點組可能無法與網格的其他部分通訊。例如,站台或網格範圍內的 IP 位址變更可能導致節點隔離。
關於此任務
節點隔離可透過以下方式表示:
-
警報,例如「無法與節點通訊」(警報 > 目前)
-
連線相關診斷(支援 > 工具 > 診斷)
節點隔離會帶來以下一些後果:
-
如果多個節點被隔離,您可能無法登入或存取 Grid Manager。
-
如果多個節點處於隔離狀態,Tenant Manager 儀表板上顯示的儲存設備使用情況和配額值可能已過時。網路連線恢復後,總計資料將會更新。
要解決隔離問題,您需要在每個隔離的節點或節點群組(子網路中不包含主要管理節點的所有節點)中與網格隔離的某個節點上執行命令列公用程式。此公用程式會為這些節點提供網格中非隔離節點的 IP 位址,從而使隔離的節點或節點群組能夠再次連接到整個網格。
|
|
如果網路中停用了多播網域名稱系統 (mDNS),則可能需要在每個隔離的節點上執行命令列公用程式。 |
步驟
如果只有部分服務離線或報告通訊錯誤,則此程序不適用。
-
存取節點並檢查 `/var/local/log/dynip.log`是否有隔離訊息。
例如:
[2018-01-09T19:11:00.545] UpdateQueue - WARNING -- Possible isolation, no contact with other nodes. If this warning persists, manual action might be required.
如果您使用的是 VMware 主控台,則會顯示一則訊息,提示該節點可能已被隔離。
在 Linux 部署中,隔離訊息會出現在 `/var/log/storagegrid/node/<nodename>.log`檔案中。
-
如果隔離訊息重複出現且持續存在,請執行以下命令:
add_node_ip.py <address>其中 `<address>`是連線至網格的遠端節點的 IP 位址。
# /usr/sbin/add_node_ip.py 10.224.4.210 Retrieving local host information Validating remote node at address 10.224.4.210 Sending node IP hint for 10.224.4.210 to local node Local node found on remote node. Update complete.
-
對先前隔離的每個節點,驗證以下內容:
-
節點的服務已啟動。
-
執行 `storagegrid-status`命令後,Dynamic IP 服務的狀態為「Running」。
-
在「節點」頁面上,該節點不再與網格的其餘部分中斷連線。
-
|
|
如果執行 `add_node_ip.py`命令後問題仍然存在,則可能存在其他連網問題需要解決。 |