Skip to main content
Workload Factory for NetApp Console
本繁體中文版使用機器翻譯,譯文僅供參考,若與英文版本牴觸,應以英文版本為準。

使用 Workload Factory 中的 Overview 儀表板進行 EDA

貢獻者 netapp-rlithman

使用概覽儀表板檢查 FSx for ONTAP 檔案系統的健全狀況和容量。您可以篩選資料、查看容量建議、調整 SSD 和處理量設定,以及審查效能趨勢,以協助決定 Volume 的放置位置以及何時擴展容量。

開始之前

您必須先"已啟動 Overview 儀表板"才能使用它來監控檔案系統。

篩選儀表板

使用儀表板頂部的篩選器可以查看特定的檔案系統。這些篩選器適用於延遲、使用率、ONTAP 事件部分以及叢集表。

步驟
  1. 登入 "NetApp Console"。

  2. 選擇選單 漢堡選單圖示用於導覽至 Workloads ,這是 Workload Factory 的選單項目,工作負載 > EDA。

  3. 選擇 Overview 標籤。

  4. 使用可用的篩選條件來縮小檢視範圍:

    • AWS 帳戶:依照與您設定的憑證關聯的一個或多個 AWS 帳戶進行篩選

    • 憑證:如果您配置了多個 AWS 憑證,請按特定憑證進行篩選

    • 區域:依一個或多個 AWS 區域篩選

  5. 更新篩選條件後,所有資訊都會重新整理,只顯示符合的檔案系統。

檢視叢集健全狀況狀態

在儀錶板頂部,您可以看到所選檔案系統的運作狀況和活動摘要。只有當至少有一個 FSx for ONTAP 連結連接到您的檔案系統時,才會顯示此摘要。

關於此任務

叢集健全狀況包括下列關鍵領域:

  • 延遲:偵測到的延遲事件數量

  • 檔案系統應變彈性:

    • SSD 容量:顯示有多少檔案系統使用「自動」、「建議」或「無」來管理 SSD 容量。

    • 處理量:顯示有多少檔案系統使用「自動」、「推薦」或「無」來管理處理量。

  • ONTAP 事件:依類別劃分的 EMS 事件數量(容量、可用性與保護、安全性及其他)

步驟
  1. 檢閱儀表板頂端的叢集健全狀況狀態。

  2. 檢視延遲事件:

    • 選取 Review 以導覽至 Latency 索引標籤

    • 如果未設定延遲監控,請選取 Configure 以設定延遲臨界值

      如需延遲監控的詳細資訊,請參閱 "設定延遲監控"。

  3. 若要檢視 FSx for ONTAP 檔案系統的 ONTAP 事件、請選取 Review 。

    ONTAP 事件檢視卡按類別(容量、可用性和保護以及安全性和其他)顯示 EMS 事件的數量。有關監控的 EMS 事件的完整列表,請參閱"ONTAP CLI 說明文件"。

檢視並套用容量或處理量建議

Workload Factory 會自動為每個 FSx for ONTAP 檔案系統執行建議。您可以透過篩選「叢集」表來尋找具有建議的檔案系統。

步驟
  1. 在「叢集」表中,依相關的時間或詳細資料欄進行篩選。

    具有容量或處理量建議的檔案系統會顯示在表格頂端。

  2. 在表格中選擇檔案系統名稱以開啟叢集詳細資料。

  3. 審查建議和圖表。

    該建議解釋了建議的變更及其背後的原因。例如:我們建議您根據檔案系統的 SSD 使用模式增加 SSD 容量。

    這張圖表顯示目前使用情況及歷史趨勢。

  4. 在圖表右上角、選取時間範圍以變更顯示的期間。

    圖表也會顯示建議決策點和自動化決策點(如果啟用了自動化模式)。將滑鼠懸停在任何決策點上,即可查看該時刻的容量建議或自動化操作的詳細資訊。

  5. 若要套用建議,請遵循建議訊息中提供的指引。

變更 SSD 管理模式

對於每個檔案系統,選擇如何管理 SSD 容量:接收手動建議或允許自動擴充。

步驟
  1. 在 Clusters 表格中找到檔案系統名稱。在其旁邊,開啟 動作功能表圖示 並選取 Change SSD capacity management。

  2. 選擇 Enable SSD capacity management,然後選擇 Apply。

  3. 選擇您偏好的模式:

    • 僅通知(建議模式)

    • 自動化

  4. 設定 SSD 容量管理參數:

    • 臨界值 (%):觸發建議的 SSD 使用率百分比

    • Lookback (%):用於分析的歷史使用資料週期

    • Lookahead (%):未來容量規劃的預期使用量

  5. 選擇 Apply。

結果

檔案系統會立即切換到新模式。如果您選擇「建議」或「自動」,系統將使用設定的參數來分析儲存容量並做出決策。

更改處理量管理模式

針對每個檔案系統,選擇如何管理處理量的增加。

步驟
  1. 在 Overview 索引標籤中,在「叢集」表中選取一個或多個檔案系統。

  2. 選擇 Change throughput management。

  3. 選擇 啟用處理量管理,然後選擇 套用。

  4. 選擇您偏好的模式:

    • 僅通知(建議模式)

    • 自動化

  5. 在對話方塊中,設定處理量管理參數:

    • 評估視窗(小時):用於分析處理量模式的時間段

    • Breached metrics (%):用於確定違規情況的百分比臨界值

    • 連續違規窗口期(小時):採取行動前連續違規行為的持續時間

    • 最小延遲(毫秒):用於確定處理量增加的延遲臨界值

    • 最大處理量(SKUs):允許的最大處理量 SKU

  6. 選擇 Apply。

結果

選定的檔案系統會立即切換至新的處理量模式。

批次編輯管理參數

一次變更多個檔案系統的設定,使相同的設定套用至您的所有叢集。

步驟
  1. 從 Overview 標籤中,選取表格中要編輯的檔案系統。

    提示 您可以選取個別檔案系統,或使用標題核取方塊來選取所有可見的檔案系統。
  2. 在表格上方選擇「變更 SSD 容量管理」或「變更處理量管理」。

  3. 選擇您偏好的模式。

  4. 在編輯對話方塊中,根據需要調整參數。

    每個參數欄位都包含一個工具提示,描述其用途和有效範圍。對話方塊會根據您的選擇顯示目前值或預設值。

  5. 選擇 Apply 以將變更套用到所有選定的檔案系統。

結果

所有選定檔案系統的參數都會更新。處於「推薦」或「自動」模式的檔案系統會立即使用新參數進行分析和決策。

使用 SSD 使用情況圖表查看儲存使用情況隨時間的變化,並找出規律。

關於此任務

圖表上的決策點表示:

  • 建議決策點:容量建議演算法識別出需要額外的 SSD 容量。

  • 自動化決策點:自動化系統嘗試增加 SSD 容量。這些點顯示操作成功或失敗的情況。

步驟
  1. 在 總覽 標籤中,選擇表格中的檔案系統名稱。

  2. 檢閱顯示歷史容量趨勢的 SSD 使用圖表。

  3. 選擇不同的時間範圍,以檢視不同期間的容量行為。

  4. 將滑鼠懸停在圖表上的決策點,即可檢視特定時刻的建議或自動化行動的詳細資訊。

  5. 使用圖表中的深入見解來:

    • 了解需要進行容量調整的頻率

    • 評估自動化或建議模式是否更適合您的工作負載模式

    • 識別反覆出現的容量限制

    • 根據成長趨勢規劃未來的容量需求

    • 疑難排解失敗的自動化嘗試

      常見故障原因包括:AWS 權限不足、檔案系統更新正在進行中、儲存設備在過去 6 小時內被修改、SSD 容量已達上限或 CloudWatch 計量不可用。

使用叢集表

叢集表詳細列出每個 FSx for ONTAP 檔案系統的效能和使用情況指標。

步驟
  1. 從 Overview 標籤檢視叢集表。

  2. 使用搜尋方塊依名稱尋找特定檔案系統。

  3. 選取欄標題以排序資料。

  4. 使用 SSD 使用情況 來識別接近容量上限的檔案系統。

  5. 使用 吞吐量使用情況 (P99) 來比較吞吐量需求與已配置的吞吐量 SKU。

    將滑鼠游標暫留在吞吐量欄標題上可查看計算詳細資料。

  6. 若要自訂欄,請選擇欄設定圖示,然後選擇要顯示的欄。

  7. 若要匯出資料,請選擇匯出圖示以下載 CSV 檔案。

最佳實務

使用 Overview 儀表板時,請參考以下建議:

  • 定期監控:經常查看儀表板,以便在趨勢演變成問題之前發現它們。

  • 設定明確的臨界值:選擇符合您的工作負載和容量規劃的 SSD 使用臨界值和處理量參數。

  • 使用篩選器:套用區域和帳戶篩選器,以便專注於您想要查看的基礎架構部分。

  • 快速審查建議:篩選叢集表,尋找具有容量或處理量建議的檔案系統。檢查並採取相應措施,以避免空間不足。

  • 選擇合適的模式:如果您希望自行審批容量或處理量變更,請使用 Recommend 模式。如果您希望系統自動管理容量或處理量,請使用 Automate 模式。

  • 注意決策點:查看容量圖上的決策點,了解系統如何做出決策,並確認設定是否符合您的需求。

  • 批次編輯:管理多個檔案系統時,使用批次編輯來保持設定一致。