Skip to main content
此產品有較新版本可以使用。
本繁體中文版使用機器翻譯,譯文僅供參考,若與英文版本牴觸,應以英文版本為準。

恢復隔離的 StorageGRID 節點的網路連線

在某些情況下,一個或多個節點組可能無法與網格的其他部分通訊。例如,站台或網格範圍內的 IP 位址變更可能導致節點隔離。

關於此任務

節點隔離可透過以下方式表示:

  • 警報,例如「無法與節點通訊」(警報 > 目前

  • 連線相關診斷(支援 > 工具 > 診斷

節點隔離會帶來以下一些後果:

  • 如果多個節點被隔離,您可能無法登入或存取 Grid Manager。

  • 如果多個節點處於隔離狀態,Tenant Manager 儀表板上顯示的儲存設備使用情況和配額值可能已過時。網路連線恢復後,總計資料將會更新。

要解決隔離問題,您需要在每個隔離的節點或節點群組(子網路中不包含主要管理節點的所有節點)中與網格隔離的某個節點上執行命令列公用程式。此公用程式會為這些節點提供網格中非隔離節點的 IP 位址,從而使隔離的節點或節點群組能夠再次連接到整個網格。

註 如果網路中停用了多播網域名稱系統 (mDNS),則可能需要在每個隔離的節點上執行命令列公用程式。
步驟

如果只有部分服務離線或報告通訊錯誤,則此程序不適用。

  1. 存取節點並檢查 `/var/local/log/dynip.log`是否有隔離訊息。

    例如:

    [2018-01-09T19:11:00.545] UpdateQueue - WARNING -- Possible isolation, no contact with other nodes.
    If this warning persists, manual action might be required.

    如果您使用的是 VMware 主控台,則會顯示一則訊息,提示該節點可能已被隔離。

    在 Linux 部署中,隔離訊息會出現在 `/var/log/storagegrid/node/<nodename>.log`檔案中。

  2. 如果隔離訊息重複出現且持續存在,請執行以下命令:

    add_node_ip.py <address>

    其中 `<address>`是連線至網格的遠端節點的 IP 位址。

    # /usr/sbin/add_node_ip.py  10.224.4.210
    
    Retrieving local host information
    Validating remote node at address 10.224.4.210
    Sending node IP hint for 10.224.4.210 to local node
    Local node found on remote node. Update complete.
  3. 對先前隔離的每個節點,驗證以下內容:

    • 節點的服務已啟動。

    • 執行 `storagegrid-status`命令後,Dynamic IP 服務的狀態為「Running」。

    • 在「節點」頁面上,該節點不再與網格的其餘部分中斷連線。

註 如果執行 `add_node_ip.py`命令後問題仍然存在,則可能存在其他連網問題需要解決。