Skip to main content
Workload Factory for NetApp Console
简体中文版经机器翻译而成,仅供参考。如与英语版出现任何冲突,应以英语版为准。

使用 Workload Factory 中的 Overview 仪表板进行 EDA

贡献者 netapp-rlithman

使用概述仪表板检查 FSx for ONTAP 文件系统的运行状况和容量。您可以过滤数据,查看容量建议,调整 SSD 和吞吐量设置,并查看性能趋势,以帮助决定在何处放置卷以及何时扩展容量。

开始之前

您必须具有 "已激活 Overview dashboard",然后才能使用它来监控文件系统。

筛选仪表板

使用仪表板顶端的筛选器查看特定的文件系统。筛选器适用于延迟、利用率、ONTAP 事件部分和集群表。

步骤
  1. 登录到 "NetApp Console"。

  2. 选择菜单 汉堡菜单图标用于导航到 Workloads,即 Workload Factory 的菜单项,Workloads > EDA。

  3. 选择 Overview 选项卡。

  4. 使用可用的筛选器来缩小视图范围:

    • AWS 账户:按与您配置的凭据关联的一个或多个 AWS 账户进行筛选

    • 凭据:如果配置了多个 AWS 凭据,请按特定 AWS 凭据进行筛选

    • 区域:按一个或多个 AWS 区域筛选

  5. 更新筛选器选择时,将刷新所有信息以仅显示匹配的文件系统。

查看集群运行状况状态

在控制面板的顶端,您可以看到所选文件系统的运行状况和活动摘要。仅当至少一个 FSx for ONTAP 链接连接到您的文件系统时,才会显示此内容。

关于此任务

集群运行状况状态包括以下关键领域:

  • 延迟:检测到的延迟事件数量

  • 文件系统弹性:

    • SSD capacity:显示有多少文件系统使用 Automate、Recommend 或 None 来管理 SSD 容量。

    • 吞吐量:显示有多少文件系统使用 Automate、Recommend 或 None 来管理吞吐量。

  • ONTAP 事件:按类别(容量、可用性和保护、安全性和其他)划分的 EMS 事件数量

步骤
  1. 查看控制面板顶部的集群运行状况状态。

  2. 要查看延迟事件:

    • 选择 Review 以导航到 Latency 选项卡

    • 如果未配置延迟监控,请选择 Configure 设置延迟阈值

      有关延迟监控的详细信息,请参阅 "配置延迟监控"。

  3. 要查看 FSx for ONTAP 文件系统的 ONTAP 事件,请选择*查看*。

    ONTAP 事件视图卡按类别(容量、可用性和保护以及安全性和其他)显示 EMS 事件的数量。有关监测的 EMS 事件的完整列表,请参见 "ONTAP CLI 文档"。

查看和应用容量或吞吐量建议

Workload Factory 会自动为每个 FSx for ONTAP 文件系统运行建议。您可以通过筛选"集群"表来查找包含建议的文件系统。

步骤
  1. 在*集群*表中,按相关时间或详细信息列进行筛选。

    具有容量或吞吐量建议的文件系统显示在表格顶部。

  2. 在表中选择文件系统名称以打开集群详细信息。

  3. 请查看推荐和图表。

    该建议解释了建议的变更及其背后的原因。例如:我们建议根据您的文件系统 SSD 使用模式增加 SSD 大小。

    该图表显示了当前的使用情况以及历史趋势。

  4. 在图表的右上角,选择时间范围以更改显示的时间段。

    该图还显示推荐决策点和自动化决策点(如果启用了自动化模式)。将鼠标悬停在任何决策点上,以查看此时有关容量建议或自动化操作的详细信息。

  5. 要应用推荐,请按照推荐消息中提供的指导进行操作。

更改 SSD 管理模式

对于每个文件系统,选择 SSD 容量的管理方式:接收手动建议或允许自动扩展。

步骤
  1. 在 Clusters 表中找到文件系统名称。在其旁边,打开 操作菜单图标 并选择 更改 SSD 容量管理。

  2. 选择 Enable SSD capacity management,然后选择 Apply。

  3. 选择您的首选模式:

    • 仅通知(推荐模式)

    • 自动化

  4. 配置 SSD 容量管理参数:

    • 阈值 (%):触发建议的 SSD 使用百分比

    • Lookback (%):用于分析的历史使用数据周期

    • Lookahead (%):未来容量规划的预计使用量

  5. 选择*应用*。

结果

文件系统立即切换到新模式。如果选择"推荐"或"自动",系统将使用设置来分析存储容量并做出决策。

更改吞吐量管理模式

对于每个文件系统,选择如何管理吞吐量增加。

步骤
  1. 在*概述*选项卡中,在集群表中选择一个或多个文件系统。

  2. 选择*更改吞吐量管理*。

  3. 选择*启用吞吐量管理*,然后选择*应用*。

  4. 选择您的首选模式:

    • 仅通知(推荐模式)

    • 自动化

  5. 在对话框中,配置吞吐量管理参数:

    • 评估窗口(小时):分析吞吐量模式的时间段

    • Breached metrics (%):用于确定违规行为的百分比阈值

    • 连续违规窗口(小时):行动前连续违规的持续时间

    • 最小延迟(毫秒):用于确定吞吐量增加的延迟阈值

    • 最大吞吐量 (SKU):允许的最大吞吐量 SKU

  6. 选择*应用*。

结果

选定的文件系统立即切换到新的吞吐量模式。

批量编辑管理参数

同时更改多个文件系统的设置,以便在集群中应用相同的设置。

步骤
  1. 从 概述 选项卡中,选择要在表中编辑的文件系统。

    提示 您可以选择单个文件系统,也可以使用标题复选框来选择所有可见的文件系统。
  2. 选择表上方的 Change SSD capacity management 或 Change throughput management。

  3. 选择您的首选模式。

  4. 在"编辑"对话框中,根据需要调整参数。

    每个参数字段都包含一个工具提示,描述其目的和有效范围。该对话框根据您的选择显示当前值或默认值。

  5. 选择 Apply 将更改应用于所有选定的文件系统。

结果

将更新所有选定文件系统的参数。处于"推荐"或"自动化"模式下的文件系统将立即使用新参数进行分析和决策。

使用 SSD 使用情况图表可查看存储使用情况如何随时间变化并发现规律。

关于此任务

图表上的决策点表示何时:

  • 推荐决策点:容量推荐算法确定需要额外的 SSD 容量。

  • 自动化决策点:自动化系统试图增加 SSD 容量。这些点显示操作是成功还是失败。

步骤
  1. 从*概述*选项卡中,在表格中选择一个文件系统名称。

  2. 查看显示历史容量趋势的 SSD 使用情况图。

  3. 选择不同的时间范围以查看不同时期的容量行为。

  4. 将鼠标悬停在图表上的决策点上,可查看特定时刻的建议或自动化操作的详细信息

  5. 使用图表中的见解:

    • 了解需要调整容量的频率

    • 评估自动化或推荐模式是否更适合您的工作负载模式

    • 识别重复性容量限制

    • 根据增长趋势规划未来的容量需求

    • 对失败的自动化尝试进行故障排除

      常见故障原因包括:AWS 权限不足、正在进行文件系统更新、最近 6 小时内修改的存储、已达到最大 SSD 容量或 CloudWatch 指标不可用。

使用集群表

集群表提供了每个 FSx for ONTAP 文件系统的详细视图以及性能和使用指标。

步骤
  1. 在 概述 选项卡中,查看集群表。

  2. 使用搜索框按名称查找特定文件系统。

  3. 选择列标题以对数据进行排序。

  4. 使用 SSD 使用情况 来识别接近容量限制的文件系统。

  5. 使用 吞吐量使用率 (P99) 将吞吐量需求与配置的吞吐量 SKU 进行比较。

    将鼠标悬停在吞吐量列标题上以获取计算详细信息。

  6. 要自定义列,请选择列设置图标并选择要显示的列。

  7. 要导出数据,请选择导出图标以下载 CSV 文件。

最佳实践

使用概览控制面板时,请考虑以下建议:

  • 定期监控:经常检查仪表板,以便在出现问题之前发现趋势。

  • 设置明确的阈值:选择适合您的工作负载和容量计划的 SSD 使用阈值和吞吐量参数。

  • 使用筛选器:应用区域和帐户筛选器,将重点放在要审核的基础架构部分。

  • 快速查看建议:筛选集群表以查找具有容量或吞吐量建议的文件系统。检查并采取措施,以避免空间耗尽。

  • 选择正确的模式:如果要自己批准容量或吞吐量更改,请使用 Recommend 模式。如果您希望系统自动管理容量或吞吐量,请使用 Automate 模式。

  • 观察决策点:检查容量图表上的决策点,了解系统如何做出决策,并确认设置是否符合您的需求。

  • 批量编辑:管理多个文件系统时,请使用批量编辑以保持设置一致。