Skip to main content
此產品有較新版本可以使用。
本繁體中文版使用機器翻譯,譯文僅供參考,若與英文版本牴觸,應以英文版本為準。

監控 StorageGRID 修復資料工作

您可以使用命令列中的 repair-data 指令碼來監控修理工作的狀態。

${post_edited_translations.segment}

註 如果您正在執行 Volume 恢復工作,請改為"在 Grid Manager 中監控進度並檢視這些作業的歷史記錄"

根據您是使用 複寫資料糾刪碼 (EC) 資料 或兩者皆用,來監控 `repair-data`工作狀態。

${post_edited_translations.segment}
  • 若要取得複寫修理的預估完成百分比,請將 show-replicated-repair-status 選項新增至 repair-data 命令。

    repair-data show-replicated-repair-status

  • 確定修理是否完成:

    1. ${post_edited_translations.segment}

    2. 請查看「評估」區段中的屬性。修理完成後,Awaiting - All 屬性將顯示 0 個物件。

  • 如需更詳細地監控修理:

    1. 選取 Nodes

    2. ${post_edited_translations.segment}

    3. ${post_edited_translations.segment}

    4. 在 ILM 佇列部分,查看以下屬性:

      • 掃描週期 - 估計值:完成所有物件的完整 ILM 掃描的估計時間。

        ${post_edited_translations.segment}

      • 修復嘗試次數:指對被視為高風險的複製資料嘗試進行物件修理操作的總次數。高風險物件是指僅剩一個複本的物件,無論該複本是由 ILM 原則指定,或是由於複本遺失所造成。每次儲存節點嘗試修理高風險物件時,此計數都會遞增。如果網格繁忙,則會優先處理高風險 ILM 修復作業。

        如果修理後複寫失敗,同一物件的修理可能會再次增量。+ 這些屬性在監控儲存節點 Volume 恢復進度時非常有用。如果嘗試修理的次數已停止增加且已完成完整掃描,則修理可能已完成。

    5. 或者,提交 storagegrid_ilm_scan_period_estimated_minutesstoragegrid_ilm_repairs_attempted 的 Prometheus 查詢。

糾刪碼(EC)資料

${post_edited_translations.segment}

  1. 確定糾刪碼資料修理的狀態:

    • 選擇 Support > Tools > 計量 以檢視目前工作預估的完成時間和完成百分比。然後,在 Grafana 區段中選擇 EC Overview。查看 網格 EC 工作預估完成時間網格 EC 工作完成百分比 儀表板。

    • 使用此命令查看特定 `repair-data`操作的狀態:

      repair-data show-ec-repair-status --repair-id repair ID

    • 使用以下命令列出所有修理項目:

      repair-data show-ec-repair-status

    輸出結果列出了所有先前和當前正在執行的修理程序的資訊,包括 repair ID

  2. 如果輸出顯示修理操作失敗,請使用 `--repair-id`選項重試修理。

    此命令使用修理 ID 6949309319275667690 重試失敗的節點修理:

    repair-data start-ec-node-repair --repair-id 6949309319275667690

    此命令使用修理 ID 6949309319275667690 重試失敗的 Volume 修理:

    repair-data start-ec-volume-repair --repair-id 6949309319275667690